無料のAIライブラリ

AIを学びましょう。永久無料。

1019 平易な英語のガイド、構造化された学習パス、オープン ライブラリ - 独立した 501(c)(3) 非営利団体によって構築され、誰でも最新の AI を理解できるようになります。

1019無料ガイド
9トピックトラック
~2 minガイドごと
~34h読書時間

ここから始めましょう

5 成果ベースのコース

各コースには、明示的な成果、マッピングされたコンピテンシー、練習アクティビティ、および適用されたキャップストーンが含まれています。

トピックトラック

トラックごとに閲覧する

気になるエリアに飛び込んでみましょう。すべてのトラックには複数のわかりやすい英語のガイドが付いています。

フルライブラリ

すべてのガイド

1019 1019 ガイドが表示されます。トラックでフィルタリングするか、上で検索してください。

ビジュアルAI

DreamFusion とスコア蒸留サンプリング

DreamFusion は、2D 画像拡散モデルを批評家として使用し、3D データでトレーニングすることはなく、テキストから 3D オブジェクトを生成します。

2 最小読み取り読む
ビジュアルAI

Magic3D テキストから 3D へのパイプライン

Magic3D は、DreamFusion に対する NVIDIA の 2 段階の回答であり、より高解像度でより詳細な 3D コンテンツをより迅速に作成します。

2 最小読み取り読む
言語AI

トークナイザーフリーのバイトレベルモデル

トークナイザーのないモデルは、単語部分の固定ボキャブラリーを削除し、生のバイトを直接操作するため、1 つのモデルであらゆる言語、コード、さらにはノイズの多いものを処理できます。

2 最小読み取り読む
言語AI

関数ベクトルとタスク表現

関数ベクトルは、「フランス語に翻訳する」や「反意語を返す」など、タスク全体をエンコードする言語モデルの隠れ状態内のコンパクトな指示です。

2 最小読み取り読む
言語AI

Best-of-N のサンプリングと再ランキング

Best-of-N サンプリングでは、モデルからいくつかの候補回答が生成され、別のスコアリング ステップを使用して最良の回答が選択されます。

2 最小読み取り読む
オーディオAI

StyleTTS 2 スタイルの普及

StyleTTS 2 は、音声の「スタイル」 (韻律、感情、話者の音色) を拡散モデルでサンプリングされた確率変数として扱うテキスト読み上げモデルです。

2 最小読み取り読む
オーディオAI

FastPitch ピッチ制御可能な TTS

FastPitch は、すべての入力トークンのピッチ (基本周波数) を明示的に予測する、高速で非自己回帰的なテキスト読み上げモデルです。

2 最小読み取り読む
オーディオAI

ボイスボックスのフローマッチング音声生成

Voicebox は、Meta のテキストガイド付き音声生成モデルで、マスクされたオーディオを「埋める」というフローマッチングの目的でトレーニングされ、1 つのモデルにゼロショット音声を実行させます。

2 最小読み取り読む
技術的な

SmoothQuant とアクティベーション クオンタイズ

SmoothQuant は、大規模な言語モデルを重みとアクティベーションの両方について 8 ビット整数まで圧縮することを可能にする技術です。

2 最小読み取り読む
技術的な

構造化プルーニングとレイヤードロップ

構造化プルーニングでは、アテンション ヘッド、ニューロン、レイヤー全体など、ニューラル ネットワークのコンポーネント全体が削除されるため、よりスリムなモデルがより高速に実行されます。

2 最小読み取り読む
技術的な

投機的ストリーミングとマルチトークン予測

投機的ストリーミングとマルチトークン予測は、複数の将来のトークンを一度に推測し、それらを一度に検証することで、言語モデルの生成を高速化します。

2 最小読み取り読む
企業

OpenAI GPT-4.5 および GPT-5

GPT-4.5 と GPT-5 は、ChatGPT とその API を強化する OpenAI の主力大規模言語モデルです。

2 最小読み取り読む

読み終わりましたか?証明してみろ。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.