無料のAIライブラリ

ビジュアルAI ガイド永久無料。

133 平易な英語のガイド、構造化された学習パス、オープン ライブラリ - 独立した 501(c)(3) 非営利団体によって構築され、誰でも最新の AI を理解できるようになります。

133無料ガイド
1トピックトラック
~2 minガイドごと
~4h読書時間

ここから始めましょう

5 成果ベースのコース

各コースには、明示的な成果、マッピングされたコンピテンシー、練習アクティビティ、および適用されたキャップストーンが含まれています。

トピックトラック

トラックごとに閲覧する

気になるエリアに飛び込んでみましょう。すべてのトラックには複数のわかりやすい英語のガイドが付いています。

フルライブラリ

すべてのガイド

133 1019 ガイドが表示されます。トラックでフィルタリングするか、上で検索してください。

ビジュアルAI

Magic3D テキストから 3D へのパイプライン

Magic3D は、DreamFusion に対する NVIDIA の 2 段階の回答であり、より高解像度でより詳細な 3D コンテンツをより迅速に作成します。

2 最小読み取り読む
ビジュアルAI

ネットワークのノイズ除去とブレ除去

ノイズ除去およびブレ除去ネットワークは、ノイズの多い画像やぼやけた画像をクリーンアップし、乱雑な入力から鮮明なディテールを回復するニューラル モデルです。

2 最小読み取り読む
ビジュアルAI

GFPGAN 顔の復元

GFPGAN は、低品質、ぼやけた、または古い顔写真を鮮明でリアルなポートレートに復元する特殊なモデルです。

2 最小読み取り読む
ビジュアルAI

CodeFormer の堅牢な顔の回復

CodeFormer は、極度の劣化に対処するために構築された顔復元モデルで、ひどく損傷した、小さな、またはぼやけた入力から認識可能な顔を復元します。

2 最小読み取り読む
ビジュアルAI

GigaGAN スケールのジェネレーター

GigaGAN は 10 億パラメータの GAN であり、敵対的生成ネットワークが拡散モデルに匹敵するテキストから画像への生成まで拡張できることを証明しています。

2 最小読み取り読む
ビジュアルAI

VQGAN とコードブック画像合成

VQGAN は、学習されたコードブックから描画された離散トークンのグリッドに画像を圧縮し、言語モデルと同じ方法でトランスフォーマーに画像を生成させます。

2 最小読み取り読む
ビジュアルAI

MaskGIT 並列トークン デコード

MaskGIT は、多くのトークンを一度に予測し、最も信頼性の高いトークンを最初に入力することで画像を生成し、遅い左から右への生成を置き換えます。

2 最小読み取り読む
ビジュアルAI

ゼロ 1 から 3 の小説ビューの普及

Zero-1-to-3 は、カメラで調整された拡散モデルを使用して、オブジェクトの 1 枚の写真を、同じオブジェクトを新しい角度から見た画像に変換します。

2 最小読み取り読む
ビジュアルAI

DMTet ハイブリッド 3D 表現

DMTet (Deep Marching Tetrahedra) は、変形可能な四面体グリッドと符号付き距離フィールドを組み合わせたハイブリッド 3D 形状表現です。

2 最小読み取り読む
ビジュアルAI

インスタント NGP ハッシュ エンコーディング

Instant-NGP は、学習可能なデータを保存することで、ニューラル ラディアンス フィールドやその他のニューラル グラフィックス プリミティブを数時間ではなく数秒でトレーニングする NVIDIA の技術です。

2 最小読み取り読む
ビジュアルAI

DepthAnything 単眼の深さ

DepthAnything は、特別なハードウェアを使用せずに、1 枚の通常の写真から各ピクセルがどのくらい離れているかを推定する基礎モデルです。

2 最小読み取り読む
ビジュアルAI

マリーゴールドの拡散深さの推定

Marigold は、事前トレーニングされた画像生成拡散モデル (安定拡散) を再利用して、非常に詳細な深度マップを予測します。

2 最小読み取り読む

読み終わりましたか?証明してみろ。

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.