مفت AI لائبریری

بصری AI رہنماہمیشہ کے لیے مفت۔

133 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔

133مفت گائیڈز
1ٹاپک ٹریکس
~2 minفی گائیڈ
~4hپڑھنے کا وقت

یہاں سے شروع کریں۔

پانچ نتائج پر مبنی کورسز

ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔

ٹاپک ٹریکس

ٹریک کے ذریعے براؤز کریں۔

اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔

مکمل لائبریری

تمام رہنما

133 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔

بصری AI

آپٹیکل کریکٹر ریکگنیشن

آپٹیکل کریکٹر ریکگنیشن (OCR) ٹیکسٹ کی تصاویر کو تبدیل کرتا ہے — اسکین شدہ دستاویزات، نشانات کی تصاویر، پی ڈی ایف — مشین کے ذریعے پڑھنے کے قابل، قابل تدوین متن میں۔

2 منٹ پڑھیںپڑھیں
بصری AI

آپٹیکل فلو

آپٹیکل فلو اندازہ لگاتا ہے کہ کس طرح ہر پکسل لگاتار ویڈیو فریموں کے درمیان حرکت کرتا ہے، جس سے موشن ویکٹر کا ایک گھنا نقشہ تیار ہوتا ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

مونوکولر گہرائی کا تخمینہ

مونوکولر گہرائی کا تخمینہ یہ پیش گوئی کرتا ہے کہ ہر پکسل ایک عام تصویر سے کتنا دور ہے — کسی سٹیریو کیمرہ، لیڈر، یا ڈیپتھ سینسر کی ضرورت نہیں ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

لیٹنٹ ڈفیوژن ماڈلز

لیٹنٹ ڈفیوژن ماڈلز خام پکسلز کی بجائے ایک کمپریسڈ لیٹنٹ اسپیس میں بازی کے عمل کو چلا کر، کمپیوٹ کے اخراجات میں کمی کرتے ہوئے تصاویر تیار کرتے ہیں۔

2 منٹ پڑھیںپڑھیں
بصری AI

کنٹرول نیٹ

ControlNet ایک ایڈ آن ہے جو امیج جنریشن ماڈلز کو قطعی ساختی کنٹرول فراہم کرتا ہے، جس سے آپ کو کناروں، پوز، گہرائی کے نقشے، یا اسکرائبلز کے ساتھ آؤٹ پٹ چلانے کی اجازت ملتی ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

درجہ بندی سے پاک رہنمائی

کلاسیفائر فری گائیڈنس وہ تکنیک ہے جو ڈفیوژن ماڈلز کو حقیقت میں آپ کے پرامپٹ کی پیروی کرنے پر مجبور کرتی ہے، اور زیادہ مضبوطی سے عمل کرنے کے لیے کچھ تنوع کی تجارت کرتی ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

بصری سلیم

بصری سلیم ایک متحرک کیمرے کو ایک نامعلوم جگہ کا نقشہ بنانے دیتا ہے اور ساتھ ہی ساتھ اس نقشے کے اندر اپنی پوزیشن کو بھی ٹریک کرتا ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

Sora اور ٹیکسٹ ٹو ویڈیو

Sora OpenAI کا ٹیکسٹ ٹو ویڈیو ماڈل ہے جو تحریری اشارے کو ایک مختصر، ہائی ریزولوشن ویڈیو کلپ میں بدل دیتا ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

ویڈیو ڈفیوژن ماڈلز

ویڈیو ڈفیوژن ماڈلز بتدریج بے ترتیب شور کو مربوط فریموں میں تبدیل کرکے، تصویروں سے وقتا فوقتا پھیلاؤ کے خیال کو بڑھاتے ہوئے متحرک تصاویر تیار کرتے ہیں۔

2 منٹ پڑھیںپڑھیں
بصری AI

ٹیکسٹ سے تھری ڈی جنریشن

ٹیکسٹ سے تھری ڈی جنریشن ایک تحریری پرامپٹ جیسے 'ونٹیج لیدر آرم چیئر' کو ایک مکمل 3D ماڈل میں بدل دیتی ہے جسے آپ کسی گیم یا منظر میں گھما سکتے ہیں، روشنی ڈال سکتے ہیں اور چھوڑ سکتے ہیں۔

2 منٹ پڑھیںپڑھیں
بصری AI

ڈیفرینٹی ایبل رینڈرنگ

ڈیفرینٹی ایبل رینڈرنگ 3D سین کو 2D امیج میں تبدیل کرنے کے عمل کو مکمل طور پر قابل تفریق بناتی ہے، تاکہ آپ رینڈر شدہ پکسلز سے گریڈیئنٹس کی گنتی کر سکیں…

2 منٹ پڑھیںپڑھیں
بصری AI

یو نیٹ آرکیٹیکچر

U-Net ایک convolutional عصبی نیٹ ورک ہے جس کی شکل 'U' کی طرح ہے جو اصل میں بائیو میڈیکل امیج سیگمنٹیشن کے لیے پکسل کے عین مطابق آؤٹ پٹ پیدا کرنے میں سبقت لیتی ہے۔

2 منٹ پڑھیںپڑھیں

پڑھنا ختم کیا؟ ثابت کرو۔

چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔

Visual AI AI Guides — Page 10 of 12 | AI Understanding