مفت AI لائبریری

بصری AI رہنماہمیشہ کے لیے مفت۔

133 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔

133مفت گائیڈز
1ٹاپک ٹریکس
~2 minفی گائیڈ
~4hپڑھنے کا وقت

یہاں سے شروع کریں۔

پانچ نتائج پر مبنی کورسز

ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔

ٹاپک ٹریکس

ٹریک کے ذریعے براؤز کریں۔

اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔

مکمل لائبریری

تمام رہنما

133 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔

بصری AI

امیج ہارمونائزیشن اور کمپوزٹنگ

تصویری ہم آہنگی خود بخود چسپاں شدہ پیش منظر آبجیکٹ کو ایڈجسٹ کرتی ہے تاکہ اس کا رنگ، لائٹنگ، اور ٹون نئے پس منظر سے میل کھاتا ہے، جس سے کمپوزٹ حقیقی نظر آتے ہیں۔

2 منٹ پڑھیںپڑھیں
بصری AI

SDXL اور کاسکیڈ ڈفیوژن

SDXL Stability AI کا ہائی ریزولیوشن ٹیکسٹ ٹو امیج ماڈل ہے جو ایک طاقتور بیس جنریٹر کو ریفائنر کے ساتھ جوڑتا ہے، جبکہ کاسکیڈڈ ڈفیوژن چینز متعدد…

2 منٹ پڑھیںپڑھیں
بصری AI

گلیگن گراؤنڈ جنریشن

GLIGEN (GLIGEN-Language-to-Image Generation) آپ کو یہ کنٹرول کرنے دیتا ہے کہ ماڈل باؤنڈنگ باکسز کو کھلا کر آپ کو یہ کنٹرول کرنے دیتا ہے کہ تخلیق کردہ امیج میں اشیاء کہاں ظاہر ہوتی ہیں…

2 منٹ پڑھیںپڑھیں
بصری AI

ملٹی کنڈیشنل ڈفیوژن کنٹرول کے لیے T2I-اڈاپٹر

ملٹی کنڈیشنل ڈفیوژن کنٹرول کے لیے T2I-اڈاپٹر سیکھیں: یہ ہلکے وزن کا استعمال کرتے ہوئے کناروں، گہرائی، پوز، اور دیگر حالات کے ساتھ مستحکم بازی کو کیسے چلاتا ہے…

2 منٹ پڑھیںپڑھیں
بصری AI

کالعدم متن کا الٹا

نال ٹیکسٹ الٹا ایک ایسی تکنیک ہے جو آپ کو اپنی ہر چیز کو برقرار رکھتے ہوئے ٹیکسٹ سے چلنے والے ڈفیوژن ماڈل جیسے اسٹیبل ڈفیوژن کے ساتھ ایک حقیقی تصویر میں ترمیم کرنے دیتی ہے…

2 منٹ پڑھیںپڑھیں
بصری AI

کسٹم ڈفیوژن ملٹی کانسیپٹ ٹیوننگ

کسٹم ڈفیوژن ایک ہلکا پھلکا ٹھیک ٹوننگ طریقہ ہے جو ٹیکسٹ ٹو امیج ماڈل کو نئے ذاتی تصورات سکھاتا ہے، جیسے کہ آپ کا کتا یا ایک مخصوص کرسی، صرف…

2 منٹ پڑھیںپڑھیں
بصری AI

لیٹنٹ بلینڈنگ اور امیج انٹرپولیشن

اویکت ملاوٹ خام پکسلز کی اوسط کے بجائے ماڈل کی پوشیدہ جگہ کے اندر ان کی کمپریسڈ نمائندگی کو جوڑ کر تصاویر کو مکس کرتی ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

روبوٹکس کے لیے ویژن-لینگویج-ایکشن ماڈلز

ویژن-لینگویج-ایکشن (VLA) ماڈل بڑے نیورل نیٹ ورکس ہیں جو کیمرے کی تصاویر کے علاوہ تحریری ہدایات اور روبوٹ موٹر کمانڈز کو براہ راست آؤٹ پٹ کرتے ہیں۔

2 منٹ پڑھیںپڑھیں
بصری AI

روبوٹ کنٹرول کے لیے پھیلاؤ کی پالیسی

ڈفیوژن پالیسی روبوٹ کنٹرول پر اسٹیبل ڈفیوژن جیسے امیج جنریٹرز کے پیچھے اسی طرح کی تردید کرنے والے آئیڈیا کا اطلاق کرتی ہے: کسی ایک اگلی کارروائی کی پیش گوئی کرنے کے بجائے…

2 منٹ پڑھیںپڑھیں
بصری AI

میک-اے-ویڈیو ٹیکسٹ ٹو ویڈیو

میک-اے-ویڈیو Meta کا 2022 کا سسٹم ہے جو ٹیکسٹ پرامپٹ کو ایک مختصر ویڈیو کلپ میں بدل دیتا ہے بغیر لیبل والے ٹیکسٹ-ویڈیو جوڑوں کی تربیت کے۔

2 منٹ پڑھیںپڑھیں
بصری AI

تصویری ویڈیو جھرن

امیجین ویڈیو Google کا 2022 کا ٹیکسٹ ٹو ویڈیو سسٹم ہے جو سات ڈفیوژن ماڈلز کے جھرن کے ذریعے کلپ بناتا ہے، ہر ایک میں مزید فریم یا زیادہ ریزولوشن شامل ہوتا ہے۔

2 منٹ پڑھیںپڑھیں
بصری AI

CogVideo اور CogVideoX

CogVideo (2022) پہلا بڑے پیمانے پر اوپن ٹیکسٹ ٹو ویڈیو ماڈل تھا، اور CogVideoX (2024) Tsinghua/Zhipu AI سے اس کا کہیں زیادہ قابل اوپن سورس جانشین ہے۔

2 منٹ پڑھیںپڑھیں

پڑھنا ختم کیا؟ ثابت کرو۔

چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔