AI 基盤
AI とは何か、システムがどのように学習し、どこで失敗するか、誇大広告なしに主張を判断する方法を理解します。
無料のAIライブラリ
117 平易な英語のガイド、構造化された学習パス、オープン ライブラリ - 独立した 501(c)(3) 非営利団体によって構築され、誰でも最新の AI を理解できるようになります。
ここから始めましょう
各コースには、明示的な成果、マッピングされたコンピテンシー、練習アクティビティ、および適用されたキャップストーンが含まれています。
AI とは何か、システムがどのように学習し、どこで失敗するか、誇大広告なしに主張を判断する方法を理解します。
プライバシーを保護し、出力をチェックし、人間の責任を守りながら、AI を生産的に使用します。
職場のユースケースを評価し、安全なパイロットを実施し、価値を測定し、責任を持って変更を伝えます。
権利、公平性、ガバナンス、安全性、公益の成果を通じて AI システムを分析します。
実践的なシステム設計を通じて、言語モデル、取得、エージェント、評価、コスト、展開の安全策を理解します。
トピックトラック
気になるエリアに飛び込んでみましょう。すべてのトラックには複数のわかりやすい英語のガイドが付いています。
フルライブラリ
117 の 1019 ガイドが表示されます。トラックでフィルタリングするか、上で検索してください。
Mimi は、音声をリアルタイムで離散トークンの小さなストリームに圧縮するニューラル オーディオ コーデックです。そのため、AI モデルは非常に低い音声で聞き、話すことができます。
オーディオAIListen, Attend and Spell (LAS) は、手作業で発音を構築することなく、音声を直接文字に転写する、2015 年の画期的なニューラル ネットワークです。
オーディオAISpecAugment は、音声のスペクトログラムをマスクおよびワープして認識モデルをより堅牢にする、シンプルだが強力なデータ拡張手法です。
オーディオAI音楽の自動タグ付けでは、機械学習を使用して曲を聴き、ジャンル、ムード、楽器、テンポなどの説明的なラベルを自動的に付けます。
オーディオAI音色転送はオーディオの「音色」を再形成し、ある楽器が別の楽器のように聞こえるようにし、鼻歌のようなメロディーをヴァイオリンやトランペットの音色に変えます…
オーディオAI音響シーン分類 (ASC) は、混雑した通り、静かな公園、電車、カフェなど、録音が行われた環境を認識するようにマシンを訓練します。
オーディオAINVIDIA Riva は、プロダクション音声 AI (ASR、TTS、翻訳) 用の GPU アクセラレーション SDK であり、NeMo はトレーニングと微調整のためのオープンソース ツールキットです…
オーディオAIDeepSpeech は、Baidu が 2014 年に導入したエンドツーエンドの音声認識モデルで、リカレント ニューラル…
オーディオAIX ベクトルは、ニューラル ネットワークによって生成される話者の声の固定長の数値指紋であり、話している内容に関係なく、誰が話しているのかを伝えるために使用されます。
オーディオAIGlow-TTS は、賢い検索トリックを使用して独自にテキストを音声に調整することを学習するテキスト読み上げモデルであり、別のアライナーの必要性を排除します。
オーディオAIParallel WaveGAN は、小型 GAN を使用してメル スペクトログラムを生のオーディオ波形に変換し、すべてのサンプルを一度に生成する高速ニューラル ボコーダーです。
オーディオAIWaveGlow は、NVIDIA のフローベースのニューラル ボコーダーで、自己回帰なしでシングル パスでメル スペクトログラムから音声波形を合成します。
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.