اے آئی فاؤنڈیشنز
سمجھیں کہ AI کیا ہے، سسٹم کیسے سیکھتے ہیں، وہ کہاں ناکام ہوتے ہیں، اور دعووں کا فیصلہ بغیر کسی قسم کے ہائپ کے کیسے کیا جائے۔
مفت AI لائبریری
117 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔
یہاں سے شروع کریں۔
ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔
سمجھیں کہ AI کیا ہے، سسٹم کیسے سیکھتے ہیں، وہ کہاں ناکام ہوتے ہیں، اور دعووں کا فیصلہ بغیر کسی قسم کے ہائپ کے کیسے کیا جائے۔
Use AI productively while protecting privacy, checking outputs, and preserving human accountability.
Evaluate workplace use cases, run safe pilots, measure value, and communicate changes responsibly.
Analyze AI systems through rights, equity, governance, safety, and public-interest outcomes.
Understand language models, retrieval, agents, evaluation, cost, and deployment safeguards through practical system design.
ٹاپک ٹریکس
اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔
مکمل لائبریری
117 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔
کور گانے کی شناخت اس وقت پتہ لگاتی ہے جب دو بہت مختلف آواز والی ریکارڈنگ دراصل ایک ہی بنیادی گانا ہوتی ہیں — ایک لائیو صوتی ورژن، ایک ریمکس…
آڈیو AIڈی ڈی ایس پی (ڈیفرینٹی ایبل ڈیجیٹل سگنل پروسیسنگ) کلاسک سنتھیسائزر بلڈنگ بلاکس کو نیورل نیٹ ورکس کے ساتھ فیوز کرتا ہے، لہذا گہرائی سے سیکھنے سے آسکیلیٹروں کو کنٹرول کیا جا سکتا ہے…
آڈیو AIVITS ایک ٹیکسٹ ٹو اسپیچ ماڈل ہے جو معمول کی دو مرحلوں والی پائپ لائن کو چھوڑتے ہوئے، ایک ہی تربیت یافتہ نظام میں متن کو براہ راست خام آڈیو ویوفارمز میں بدل دیتا ہے۔
آڈیو AIفاسٹ اسپیچ ایک وقت میں ایک فریم کے بجائے متوازی طور پر ایک مکمل اسپیچ سپیکٹروگرام تیار کرتا ہے، جس سے ترکیب کو ڈرامائی طور پر تیز اور زیادہ مستحکم ہوتا ہے۔
آڈیو AINaturalSpeech Microsoft TTS تحقیق کی ایک سطر ہے جس کا مقصد انسانی سطح کی تقریر کے معیار کے لیے ہے، جس کے بعد کے ورژن دیرپا پھیلاؤ کو استعمال کرتے ہوئے بھرپور، قدرتی…
آڈیو AIاسپیچ ایموشن ریکگنیشن (SER) AI ہے جو کہ بولنے والے کی جذباتی حالت کا پتہ لگاتا ہے — غصہ، خوشی، اداسی، مایوسی — ان کی آواز کی آواز سے، نہ صرف…
آڈیو AIMoshi Kyutai کی طرف سے ایک اوپن سورس، ریئل ٹائم وائس AI ہے جو سخت موڑ لینے کے بجائے - ایک ہی وقت میں بات کرتی اور سنتی ہے۔
آڈیو AIاسپیچ ٹو اسپیچ ٹرانسلیشن (S2ST) ایک زبان میں بولے جانے والے الفاظ لیتا ہے اور دوسری زبان میں بولے جانے والے الفاظ تیار کرتا ہے — مثالی طور پر بولنے والے کی آواز، لہجے کو محفوظ رکھتا ہے…
آڈیو AIHiFi-GAN ایک تخلیقی-مخالف ووکوڈر ہے جو ایک میل سپیکٹروگرام کو تقریباً فوری طور پر خام آڈیو ویوفارم میں بدل دیتا ہے، جس سے اسٹوڈیو کے معیار کی تقریر پیدا ہوتی ہے…
آڈیو AIگرافیم سے فونیم (G2P) کی تبدیلی تحریری حروف کو ان آوازوں میں ترجمہ کرتی ہے جن کا اصل میں اسپیچ سسٹم کو تلفظ کرنا چاہیے۔
آڈیو AIٹیکسٹ نارملائزیشن ایک فرنٹ اینڈ مرحلہ ہے جو اسپیچ سسٹم کے کہنے سے پہلے خام لکھے ہوئے متن کو مکمل طور پر بولے جانے والے الفاظ میں دوبارہ لکھتا ہے۔
آڈیو AIساؤنڈ اسٹریم Google کا اینڈ ٹو اینڈ نیورل آڈیو کوڈیک ہے جو کوالٹی کو محفوظ رکھتے ہوئے اسپیچ اور میوزک کو انتہائی کم بٹریٹس پر کمپریس کرتا ہے۔
چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔