AI 基盤
AI とは何か、システムがどのように学習し、どこで失敗するか、誇大広告なしに主張を判断する方法を理解します。
無料のAIライブラリ
117 平易な英語のガイド、構造化された学習パス、オープン ライブラリ - 独立した 501(c)(3) 非営利団体によって構築され、誰でも最新の AI を理解できるようになります。
ここから始めましょう
各コースには、明示的な成果、マッピングされたコンピテンシー、練習アクティビティ、および適用されたキャップストーンが含まれています。
AI とは何か、システムがどのように学習し、どこで失敗するか、誇大広告なしに主張を判断する方法を理解します。
プライバシーを保護し、出力をチェックし、人間の責任を守りながら、AI を生産的に使用します。
職場のユースケースを評価し、安全なパイロットを実施し、価値を測定し、責任を持って変更を伝えます。
権利、公平性、ガバナンス、安全性、公益の成果を通じて AI システムを分析します。
実践的なシステム設計を通じて、言語モデル、取得、エージェント、評価、コスト、展開の安全策を理解します。
トピックトラック
気になるエリアに飛び込んでみましょう。すべてのトラックには複数のわかりやすい英語のガイドが付いています。
フルライブラリ
117 の 1019 ガイドが表示されます。トラックでフィルタリングするか、上で検索してください。
DiffWave は、メル スペクトログラムに基づいてランダム ノイズを波形に繰り返しノイズ除去することでオーディオを合成する拡散ベースのボコーダーです。
オーディオAIBark は、Suno のオープンソースのテキスト音声変換モデルで、音声だけでなく、笑い声、ため息、音楽、効果音をテキスト プロンプトから直接生成します。
オーディオAITortoise TTS は、オープンソースのテキスト読み上げシステムで、非常に自然で感情豊かな音声と、わずか数本の短い音声からの強力な音声クローンで高く評価されています。
オーディオAIXTTS は Coqui の多言語テキスト読み上げモデルで、短いクリップから音声を複製し、音声を保存しながらさまざまな言語で話すことができます。
オーディオAISoundStorm は、一度に 1 つのトークンではなく音声とサウンドを並行して生成する Google オーディオ生成モデルであり、高品質のオーディオ合成を実現します。
オーディオAIAudioGen は、テキストの説明を「鳥のさえずり中に犬が吠える」などの現実的な環境音や音響効果に変換する Meta モデルです。
オーディオAIStable Audio は、潜在拡散を使用して音楽とサウンド効果を生成し、クリップの長さを明示的に制御する、Stability AI のテキスト音声変換システムです。
オーディオAIKaldi は、音声認識システムを構築するための主要な研究プラットフォームとなった無料のオープンソース ツールキットです。
オーディオAIWav2Letter は Facebook AI のエンドツーエンドの音声認識システムで、再帰性のない畳み込みニューラル ネットワークのみを使用します。
オーディオAIJasper と QuartzNet は、NVIDIA のエンドツーエンドの畳み込み音声認識モデルであり、QuartzNet は劇的に小型で効率的な再設計です…
オーディオAI拡散モデルは、段階的なノイズ処理を逆転することを学習することでオーディオを生成し、ランダムなノイズを一貫した音声、音楽、効果音に変換します。
オーディオAIサウンド イベント検出 (SED) は、オーディオ ストリーム内で発生するサウンドと、その開始と終了を正確に識別します。
Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.