مفت AI لائبریری

آڈیو AI رہنماہمیشہ کے لیے مفت۔

117 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔

117مفت گائیڈز
1ٹاپک ٹریکس
~2 minفی گائیڈ
~4hپڑھنے کا وقت

یہاں سے شروع کریں۔

پانچ نتائج پر مبنی کورسز

ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔

ٹاپک ٹریکس

ٹریک کے ذریعے براؤز کریں۔

اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔

مکمل لائبریری

تمام رہنما

117 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔

آڈیو AI

سپلیٹر اسٹیم سیپریشن

Spleeter Deezer کا ایک اوپن سورس ٹول ہے جو گہری سیکھنے کا استعمال کرتے ہوئے ایک تیار شدہ گانے کو الگ الگ ٹریکس (ووکلز، ڈرم، باس اور مزید) میں تقسیم کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

کریپ پچ تخمینہ

CREPE ایک گہری سیکھنے والا ماڈل ہے جو ایک monophonic آڈیو سگنل کی بنیادی تعدد (پچ) کا براہ راست اس کے خام ویوفارم سے اندازہ لگاتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

PESQ اور STOI اسپیچ کوالٹی میٹرکس

PESQ اور STOI معیاری معروضی میٹرکس ہیں جو اسکور کرتے ہیں کہ انسانی سننے والوں کی ضرورت کے بغیر پروسیس شدہ تقریر کتنی اچھی لگتی ہے اور یہ کتنی قابل فہم ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

سورس فلٹر ووکوڈنگ اور ورلڈ

ووکوڈر ایک ایسا ٹول ہے جو تقریر کو اپنے بلڈنگ بلاکس میں لے جاتا ہے اور اسے دوبارہ بناتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

مطلب رائے سکور کی تشخیص

مین اوپینین سکور (MOS) انسانی سننے والوں کی 1 سے 5 اوسط درجہ بندی ہے جو یہ پیمائش کرتی ہے کہ کتنی اچھی سنتھیسائز یا ٹرانسمٹ شدہ آڈیو آوازیں آتی ہیں۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

آڈیو کے لیے Constant-Q ٹرانسفارم

Constant-Q ٹرانسفارم (CQT) ایک فریکوئنسی تجزیہ ہے جو یکساں فاصلہ والے ڈبوں کے بجائے میوزیکل پچ سے مماثل لوگاریتھمک طور پر فاصلہ والے ڈبوں کا استعمال کرتا ہے…

2 منٹ پڑھیںپڑھیں
آڈیو AI

فلٹر بینک اور پی ایل پی کی خصوصیات

Filterbank اور Perceptual Linear Prediction (PLP) خصوصیات اسپیچ سگنل کو کمپیکٹ، ادراک کے لحاظ سے معنی خیز نمبروں میں خلاصہ کرنے کے طریقے ہیں جو مشین…

2 منٹ پڑھیںپڑھیں
آڈیو AI

StyleTTS 2 انداز بازی

StyleTTS 2 ایک ٹیکسٹ ٹو اسپیچ ماڈل ہے جو آواز کے 'انداز' - پراسوڈی، جذبات، اور اسپیکر ٹمبر کو - ایک ڈفیوژن ماڈل کے ساتھ نمونے کے بے ترتیب متغیر کے طور پر پیش کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

فاسٹ پِچ پچ-کنٹرول ایبل TTS

FastPitch ایک تیز رفتار، غیر خودکار ٹیکسٹ ٹو اسپیچ ماڈل ہے جو واضح طور پر ہر ان پٹ ٹوکن کی پچ (بنیادی فریکوئنسی) کی پیش گوئی کرتا ہے، آپ کو…

2 منٹ پڑھیںپڑھیں
آڈیو AI

وائس باکس فلو میچنگ اسپیچ جنریشن

وائس باکس Meta کا ٹیکسٹ گائیڈڈ اسپیچ جنریشن ماڈل ہے جس کو فلو میچنگ مقصد کے ساتھ ماسکڈ آڈیو کو 'فل ان' کرنے کے لیے تربیت دی گئی ہے، جس سے ایک ماڈل کو صفر شاٹ آواز کرنے کی اجازت دی جائے گی…

2 منٹ پڑھیںپڑھیں
آڈیو AI

گہرا شور دبانے کا چیلنج

ڈیپ نوائس سپریشن (DNS) چیلنج ایک Microsoft کا مقابلہ ہے جو محققین کو اعصابی نیٹ ورک بنانے پر مجبور کرتا ہے جو پس منظر کے شور کو ختم کرتا ہے…

2 منٹ پڑھیںپڑھیں
آڈیو AI

سپیکٹرل گھٹاؤ اور وینر فلٹرنگ

سپیکٹرل گھٹاؤ اور وینر فلٹرنگ شور کو کم کرنے کے کلاسک، پری ڈیپ لرننگ ورک ہارسز ہیں۔

2 منٹ پڑھیںپڑھیں

پڑھنا ختم کیا؟ ثابت کرو۔

چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔