مفت AI لائبریری

آڈیو AI رہنماہمیشہ کے لیے مفت۔

117 سادہ انگریزی گائیڈز، سیکھنے کے ڈھانچے کے راستے، اور ایک کھلی لائبریری — جسے ایک آزاد 501(c)(3) غیر منفعتی تنظیم نے بنایا ہے تاکہ کوئی بھی جدید AI کو سمجھ سکے۔

117مفت گائیڈز
1ٹاپک ٹریکس
~2 minفی گائیڈ
~4hپڑھنے کا وقت

یہاں سے شروع کریں۔

پانچ نتائج پر مبنی کورسز

ہر کورس میں واضح نتائج، نقشہ سازی کی قابلیت، مشق کی سرگرمیاں، اور لاگو کیپ اسٹون شامل ہیں۔

ٹاپک ٹریکس

ٹریک کے ذریعے براؤز کریں۔

اس علاقے میں جائیں جس کا آپ کو خیال ہے۔ ہر ٹریک میں متعدد سادہ انگریزی گائیڈز ہوتے ہیں۔

مکمل لائبریری

تمام رہنما

117 کی 1019 گائیڈز دکھائے گئے ہیں۔ ٹریک کے لحاظ سے فلٹر کریں یا اوپر تلاش کریں۔

آڈیو AI

ڈف ویو ڈفیوژن ووکوڈر

DiffWave ایک پھیلاؤ پر مبنی ووکوڈر ہے جو mel-spectrogram پر مشروط طور پر بے ترتیب شور کو ایک لہر کی شکل میں رد کرکے آڈیو کی ترکیب کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

بارک جنریٹو آڈیو ماڈل

بارک سنو کا ایک اوپن سورس ٹیکسٹ ٹو آڈیو ماڈل ہے جو ٹیکسٹ پرامپٹس سے نہ صرف تقریر بلکہ ہنسی، آہیں، موسیقی اور صوتی اثرات پیدا کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

کچھوا ٹی ٹی ایس آٹوریگریسو ترکیب

Tortoise TTS ایک اوپن سورس ٹیکسٹ ٹو اسپیچ سسٹم ہے جو غیر معمولی قدرتی، جذباتی طور پر بھرپور آوازوں اور صرف چند مختصر سے مضبوط آواز کی کلوننگ کے لیے قیمتی ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

XTTS کراس لینگوئل وائس کلوننگ

XTTS Coqui کا کثیر لسانی ٹیکسٹ ٹو اسپیچ ماڈل ہے جو ایک مختصر کلپ سے آواز کا کلون بنا سکتا ہے اور پھر اسے محفوظ رکھتے ہوئے کئی مختلف زبانوں میں بول سکتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

SoundStorm متوازی آڈیو جنریشن

SoundStorm ایک Google آڈیو جنریشن ماڈل ہے جو ایک وقت میں ایک ٹوکن کے بجائے متوازی طور پر تقریر اور آواز پیدا کرتا ہے، اعلیٰ معیار کی آڈیو ترکیب بناتا ہے…

2 منٹ پڑھیںپڑھیں
آڈیو AI

آڈیوجن ٹیکسٹ ٹو آڈیو ترکیب

AudioGen ایک Meta ماڈل ہے جو متن کی تفصیل کو حقیقت پسندانہ ماحولیاتی آوازوں اور صوتی اثرات میں بدل دیتا ہے، جیسے 'کتے کے بھونکتے ہوئے پرندے چہچہاتے ہیں۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

مستحکم آڈیو لیٹنٹ ڈفیوژن

اسٹیبل آڈیو اسٹیبلٹی اے آئی کا ٹیکسٹ ٹو آڈیو سسٹم ہے جو کلپ کی لمبائی پر واضح کنٹرول کے ساتھ موسیقی اور صوتی اثرات پیدا کرنے کے لیے لیٹنٹ ڈفیوژن کا استعمال کرتا ہے۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

کالدی اسپیچ ریکگنیشن ٹول کٹ

Kaldi ایک مفت، اوپن سورس ٹول کٹ ہے جو تقریر کی شناخت کے نظام کی تعمیر کے لیے ایک اہم تحقیقی پلیٹ فارم بن گئی۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

Wav2Letter Convolutional ASR

Wav2Letter Facebook AI کا ایک اختتام سے آخر تک تقریر کی شناخت کا نظام ہے جس میں صرف convolutional عصبی نیٹ ورک استعمال کیے جاتے ہیں، کوئی تکرار نہیں۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

Jasper اور QuartzNet ASR

Jasper اور QuartzNet NVIDIA کے آخر سے لے کر آخر تک تصنیفاتی تقریر کی شناخت کے ماڈل ہیں، کوارٹز نیٹ ڈرامائی طور پر چھوٹا، موثر دوبارہ ڈیزائن ہے…

2 منٹ پڑھیںپڑھیں
آڈیو AI

آڈیو کے لیے ڈفیوژن ماڈلز

ڈفیوژن ماڈلز قدم بہ قدم شور کرنے کے عمل کو ریورس کرنا سیکھ کر آڈیو تیار کرتے ہیں، بے ترتیب شور کو مربوط تقریر، موسیقی یا صوتی اثرات میں تبدیل کرتے ہیں۔

2 منٹ پڑھیںپڑھیں
آڈیو AI

صوتی واقعہ کا پتہ لگانا

ساؤنڈ ایونٹ ڈٹیکشن (SED) اس بات کی نشاندہی کرتا ہے کہ آڈیو اسٹریم میں کون سی آوازیں آتی ہیں اور بالکل کب شروع ہوتی ہیں اور بند ہوتی ہیں۔

2 منٹ پڑھیںپڑھیں

پڑھنا ختم کیا؟ ثابت کرو۔

چیک کریں کہ آپ نے موضوع کے کوئز کے ساتھ کیا سیکھا، پھر ہمارے سٹرکچرڈ کورسز اور موجودہ سرٹیفیکیشن کے تقاضوں کو دریافت کریں۔ بنیادی رہنما پڑھنے کے لیے آزاد رہتے ہیں۔

Audio AI AI Guides — Page 7 of 10 | AI Understanding