無料のAIライブラリ

オーディオAI ガイド永久無料。

117 平易な英語のガイド、構造化された学習パス、オープン ライブラリ - 独立した 501(c)(3) 非営利団体によって構築され、誰でも最新の AI を理解できるようになります。

117無料ガイド
1トピックトラック
~2 minガイドごと
~4h読書時間

ここから始めましょう

5 成果ベースのコース

各コースには、明示的な成果、マッピングされたコンピテンシー、練習アクティビティ、および適用されたキャップストーンが含まれています。

トピックトラック

トラックごとに閲覧する

気になるエリアに飛び込んでみましょう。すべてのトラックには複数のわかりやすい英語のガイドが付いています。

フルライブラリ

すべてのガイド

117 1019 ガイドが表示されます。トラックでフィルタリングするか、上で検索してください。

オーディオAI

スノとウディオ

Suno と Udio は、消費者向け AI 音楽ジェネレーターの 2 つで、短いテキスト プロンプトをスタジオに近い品質の完全な曲 (ボーカル付き) に変換します。

2 最小読み取り読む
オーディオAI

象徴的な音楽の生成

シンボリック音楽生成では、生のオーディオとしてではなく、構造化された記譜法 (ノート、ピッチ、デュレーション、タイミング (多くの場合 MIDI)) として音楽が作成されます。

2 最小読み取り読む
オーディオAI

メル周波数ケプストラム係数

メル周波数ケプストラム係数 (MFCC) は、人間の耳が知覚する音の周波数スペクトルの形状を要約したコンパクトな数値セットです。

2 最小読み取り読む
オーディオAI

ウェーブネット

2016 年に DeepMind によって導入された WaveNet は、生のオーディオを一度に 1 サンプルずつ生成し、驚くほど自然な音声を生成する画期的なニューラル ネットワークでした。

2 最小読み取り読む
オーディオAI

タコトロン2

Tacotron 2 は、Google (2017) のエンドツーエンドのテキスト読み上げシステムで、書かれたテキストをメル スペクトログラムに直接変換し、ニューラル ボコーダーが変換します。

2 最小読み取り読む
オーディオAI

音声ディープフェイク検出

音声ディープフェイク検出は、音声録音が本物の人間によって話されたものなのか、それとも AI によって合成/複製されたものなのかを判断するために使用される一連の技術です。

2 最小読み取り読む
オーディオAI

韻律モデリング

韻律モデリングは、言葉の上に乗せられる音声のメロディー、リズム、ピッチ、強勢、ペースを機械に教えます。

2 最小読み取り読む
オーディオAI

感情的な音声合成

感情的な音声合成は、幸せ、悲しみ、怒り、穏やかな声を生成し、理解できるだけでなく、実際に感じられる声を生成します。

2 最小読み取り読む
オーディオAI

音声変換

音声変換は、ある人の録音された音声を変換し、元の単語とタイミングを維持したまま、別の人が話したように聞こえるようにします。

2 最小読み取り読む
オーディオAI

スピーカーのダイアライゼーション

話者ダイアリゼーションは、「誰がいつ話したか?」という質問に答えます。オーディオ録音を、話者の ID によってラベル付けされたセグメントに分割することによって。

2 最小読み取り読む
オーディオAI

話者の検証

話者検証は、音声が主張された特定の ID と一致するかどうかを確認し、音声ベースのパスワードとして機能します。

2 最小読み取り読む
オーディオAI

音声アクティビティの検出

音声アクティビティ検出 (VAD) は、オーディオ信号に人間の音声が含まれているか、それとも単なる沈黙とノイズが含まれているかを瞬間ごとに判断します。

2 最小読み取り読む

読み終わりましたか?証明してみろ。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 9 of 10 | AI Understanding