اے آئی فاؤنڈیشنز
سمجھیں کہ AI کیا ہے، سسٹم کیسے سیکھتے ہیں، وہ کہاں ناکام ہوتے ہیں، اور دعووں کا فیصلہ بغیر کسی قسم کے ہائپ کے کیسے کیا جائے۔
مفت AI لائبریری
117 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔
یہاں سے شروع کریں۔
ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔
سمجھیں کہ AI کیا ہے، سسٹم کیسے سیکھتے ہیں، وہ کہاں ناکام ہوتے ہیں، اور دعووں کا فیصلہ بغیر کسی قسم کے ہائپ کے کیسے کیا جائے۔
Use AI productively while protecting privacy, checking outputs, and preserving human accountability.
Evaluate workplace use cases, run safe pilots, measure value, and communicate changes responsibly.
Analyze AI systems through rights, equity, governance, safety, and public-interest outcomes.
Understand language models, retrieval, agents, evaluation, cost, and deployment safeguards through practical system design.
ٹاپک ٹریکس
اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔
مکمل لائبریری
117 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔
DiffWave ایک پھیلاؤ پر مبنی ووکوڈر ہے جو mel-spectrogram پر مشروط طور پر بے ترتیب شور کو ایک لہر کی شکل میں رد کرکے آڈیو کی ترکیب کرتا ہے۔
آڈیو AIبارک سنو کا ایک اوپن سورس ٹیکسٹ ٹو آڈیو ماڈل ہے جو ٹیکسٹ پرامپٹس سے نہ صرف تقریر بلکہ ہنسی، آہیں، موسیقی اور صوتی اثرات پیدا کرتا ہے۔
آڈیو AITortoise TTS ایک اوپن سورس ٹیکسٹ ٹو اسپیچ سسٹم ہے جو غیر معمولی قدرتی، جذباتی طور پر بھرپور آوازوں اور صرف چند مختصر سے مضبوط آواز کی کلوننگ کے لیے قیمتی ہے۔
آڈیو AIXTTS Coqui کا کثیر لسانی ٹیکسٹ ٹو اسپیچ ماڈل ہے جو ایک مختصر کلپ سے آواز کا کلون بنا سکتا ہے اور پھر اسے محفوظ رکھتے ہوئے کئی مختلف زبانوں میں بول سکتا ہے۔
آڈیو AISoundStorm ایک Google آڈیو جنریشن ماڈل ہے جو ایک وقت میں ایک ٹوکن کے بجائے متوازی طور پر تقریر اور آواز پیدا کرتا ہے، اعلیٰ معیار کی آڈیو ترکیب بناتا ہے…
آڈیو AIAudioGen ایک Meta ماڈل ہے جو متن کی تفصیل کو حقیقت پسندانہ ماحولیاتی آوازوں اور صوتی اثرات میں بدل دیتا ہے، جیسے 'کتے کے بھونکتے ہوئے پرندے چہچہاتے ہیں۔
آڈیو AIاسٹیبل آڈیو اسٹیبلٹی اے آئی کا ٹیکسٹ ٹو آڈیو سسٹم ہے جو کلپ کی لمبائی پر واضح کنٹرول کے ساتھ موسیقی اور صوتی اثرات پیدا کرنے کے لیے لیٹنٹ ڈفیوژن کا استعمال کرتا ہے۔
آڈیو AIKaldi ایک مفت، اوپن سورس ٹول کٹ ہے جو تقریر کی شناخت کے نظام کی تعمیر کے لیے ایک اہم تحقیقی پلیٹ فارم بن گئی۔
آڈیو AIWav2Letter Facebook AI کا ایک اختتام سے آخر تک تقریر کی شناخت کا نظام ہے جس میں صرف convolutional عصبی نیٹ ورک استعمال کیے جاتے ہیں، کوئی تکرار نہیں۔
آڈیو AIJasper اور QuartzNet NVIDIA کے آخر سے لے کر آخر تک تصنیفاتی تقریر کی شناخت کے ماڈل ہیں، کوارٹز نیٹ ڈرامائی طور پر چھوٹا، موثر دوبارہ ڈیزائن ہے…
آڈیو AIڈفیوژن ماڈلز قدم بہ قدم شور کرنے کے عمل کو ریورس کرنا سیکھ کر آڈیو تیار کرتے ہیں، بے ترتیب شور کو مربوط تقریر، موسیقی یا صوتی اثرات میں تبدیل کرتے ہیں۔
آڈیو AIساؤنڈ ایونٹ ڈٹیکشن (SED) اس بات کی نشاندہی کرتا ہے کہ آڈیو اسٹریم میں کون سی آوازیں آتی ہیں اور بالکل کب شروع ہوتی ہیں اور بند ہوتی ہیں۔
چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔