無料のAIライブラリ

AIを学びましょう。永久無料。

1019 平易な英語のガイド、構造化された学習パス、オープン ライブラリ - 独立した 501(c)(3) 非営利団体によって構築され、誰でも最新の AI を理解できるようになります。

1019無料ガイド
9トピックトラック
~2 minガイドごと
~34h読書時間

ここから始めましょう

5 成果ベースのコース

各コースには、明示的な成果、マッピングされたコンピテンシー、練習アクティビティ、および適用されたキャップストーンが含まれています。

トピックトラック

トラックごとに閲覧する

気になるエリアに飛び込んでみましょう。すべてのトラックには複数のわかりやすい英語のガイドが付いています。

フルライブラリ

すべてのガイド

1019 1019 ガイドが表示されます。トラックでフィルタリングするか、上で検索してください。

技術的な

Kubernetes での KServe とモデルの提供

KServe は、機械学習モデルを大規模に提供するための標準化された Kubernetes ネイティブ プラットフォームです。

2 最小読み取り読む
技術的な

Seldon コアと推論グラフ

Seldon Core は、Kubernetes 上に機械学習モデルをデプロイするためのオープンソース プラットフォームであり、推論グラフという傑出した機能を備えています。

2 最小読み取り読む
ビジュアルAI

画像プロンプト用の IP アダプター

IP-Adapter は、Stable Diffusion などの拡散モデルがテキストだけでなく画像をプロンプトとして受け入れることができる軽量のアドオンです。

2 最小読み取り読む
ビジュアルAI

Imagen テキストから画像へ

Imagen は、Google のテキストから画像へのシステムであり、書かれた説明を写真のようにリアルな画像に変換します。

2 最小読み取り読む
ビジュアルAI

GLIDE ディフュージョンモデル

GLIDE は初期の OpenAI テキストから画像への拡散モデルで、プロンプトに加えて「分類子を使用しないガイダンス」を表示することで、初期の GAN ベースのシステムを打ち負かすことができました。

2 最小読み取り読む
オーディオAI

音楽の自動タグ付け

音楽の自動タグ付けでは、機械学習を使用して曲を聴き、ジャンル、ムード、楽器、テンポなどの説明的なラベルを自動的に付けます。

2 最小読み取り読む
オーディオAI

音楽的な音色の転送

音色転送はオーディオの「音色」を再形成し、ある楽器が別の楽器のように聞こえるようにし、鼻歌のようなメロディーをヴァイオリンやトランペットの音色に変えます…

2 最小読み取り読む
オーディオAI

音響シーンの分類

音響シーン分類 (ASC) は、混雑した通り、静かな公園、電車、カフェなど、録音が行われた環境を認識するようにマシンを訓練します。

2 最小読み取り読む
オーディオAI

NVIDIA Riva と NeMo のスピーチ

NVIDIA Riva は、プロダクション音声 AI (ASR、TTS、翻訳) 用の GPU アクセラレーション SDK であり、NeMo はトレーニングと微調整のためのオープンソース ツールキットです…

2 最小読み取り読む
オーディオAI

DeepSpeech アーキテクチャ

DeepSpeech は、Baidu が 2014 年に導入したエンドツーエンドの音声認識モデルで、リカレント ニューラル…

2 最小読み取り読む
オーディオAI

X-Vector スピーカーの埋め込み

X ベクトルは、ニューラル ネットワークによって生成される話者の声の固定長の数値指紋であり、話している内容に関係なく、誰が話しているのかを伝えるために使用されます。

2 最小読み取り読む
言語AI

密集した通路の検索

Dense Passage Retrieval (DPR) は、単語の一致ではなく、質問とパッセージの意味を数値ベクトルとして比較することにより、関連するテキストを見つけます。

2 最小読み取り読む

読み終わりましたか?証明してみろ。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.