مفت AI لائبریری

آڈیو AI رہنماہمیشہ کے لیے مفت۔

117 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔

117مفت گائیڈز
1ٹاپک ٹریکس
~2 minفی گائیڈ
~4hپڑھنے کا وقت

یہاں سے شروع کریں۔

پانچ نتائج پر مبنی کورسز

ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔

ٹاپک ٹریکس

ٹریک کے ذریعے براؤز کریں۔

اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔

مکمل لائبریری

تمام رہنما

117 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔

آڈیو AI

آڈیو کیپشننگ

آڈیو کیپشننگ آڈیو کلپ کے مواد کو بیان کرنے والا ایک فطری زبان کا جملہ تیار کرتا ہے، جیسے کہ 'ٹرین کا ہارن جب لیول کراسنگ سے گزرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

سرگوشی کی تقریر کی پہچان

Whisper OpenAI کا اوپن سورس خودکار اسپیچ ریکگنیشن سسٹم ہے جو آڈیو کو 90+ زبانوں میں متن میں بدل دیتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

Wav2Vec 2.0

Wav2Vec 2.0 Meta AI کا خود زیر نگرانی اسپیچ ماڈل ہے جو خام، بغیر لیبل والی ریکارڈنگ سے طاقتور آڈیو نمائندگی سیکھتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

ہیوبرٹ کی خود زیر نگرانی تقریر

HuBERT (Hidden-Unit BERT) Meta AI کا خود زیر نگرانی اسپیچ ماڈل ہے جو نقاب پوش حصوں، BERT طرز کے کلسٹرڈ آڈیو یونٹس کی پیشین گوئی کرکے سیکھتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

نیورل ووکوڈرز

نیورل ووکوڈر ایک ایسا ماڈل ہے جو ایک کمپیکٹ صوتی نمائندگی، عام طور پر ایک میل سپیکٹروگرام، کو ایک حقیقی قابل سماعت موج میں بدل دیتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

نیورل آڈیو کوڈیکس

اعصابی آڈیو کوڈیکس مجرد ٹوکنز کے چھوٹے چھوٹے سلسلے میں آواز کو کمپریس کرنے اور اسے اعلیٰ وفاداری کے ساتھ دوبارہ تشکیل دینے کے لیے گہری سیکھنے کا استعمال کرتے ہیں۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

VALL-E اور کوڈیک زبان کے ماڈلز

VALL-E نے آڈیو کوڈیک ٹوکنز پر زبان کی ماڈلنگ کے مسئلے کے طور پر ٹیکسٹ ٹو اسپیچ کو ری فریم کیا، جس سے نمونے کے صرف تین سیکنڈز سے صوتی کلوننگ کو فعال کیا جا سکتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

OpenAI سرگوشی

Whisper OpenAI کا اوپن سورس خودکار اسپیچ ریکگنیشن سسٹم ہے جو درجنوں زبانوں میں بولی جانے والی آڈیو کو نقل اور ترجمہ کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

خودکار میوزک ٹرانسکرپشن

آٹومیٹک میوزک ٹرانسکرپشن (AMT) موسیقی کی خام آڈیو ریکارڈنگ کو شیٹ میوزک، MIDI، یا پیانو رول جیسے علامتی اشارے میں تبدیل کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

بیٹ اور ٹیمپو ٹریکنگ

بیٹ اور ٹیمپو ٹریکنگ موسیقی میں مستحکم نبض کو تلاش کرنے کا کام ہے: ہر بیٹ کہاں گرتی ہے اور گانا کتنی تیزی سے دھڑکن فی منٹ (BPM) میں حرکت کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

آڈیو فنگر پرنٹنگ

آڈیو فنگر پرنٹنگ آواز کا ایک کمپیکٹ، شور مزاحم ڈیجیٹل دستخط بناتا ہے تاکہ اسے بعد میں پہچانا جا سکے، یہاں تک کہ پس منظر کے شور کے ذریعے بھی…

2 منٹ پڑھیںپڑھیں
آڈیو AI

جوک باکس

جوک باکس OpenAI کا 2020 کا نیورل نیٹ ورک ہے جو خام میوزک آڈیو تیار کرتا ہے — گانے کی آوازوں، آلات اور یہاں تک کہ مخصوص انداز میں گانے کے ساتھ مکمل…

2 منٹ پڑھیںپڑھیں

پڑھنا ختم کیا؟ ثابت کرو۔

چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔