مكتبة الذكاء الاصطناعي المجانية

الذكاء الاصطناعي الصوتي أدلةمجانا إلى الأبد.

117 أدلة باللغة الإنجليزية البسيطة، ومسارات تعليمية منظمة، ومكتبة مفتوحة - تم إنشاؤها بواسطة منظمة غير ربحية مستقلة 501(c)(3) حتى يتمكن أي شخص من فهم الذكاء الاصطناعي الحديث.

117أدلة مجانية
1مسارات الموضوع
~2 minلكل دليل
~4hوقت القراءة

ابدأ هنا

خمسة الدورات القائمة على النتائج

تتضمن كل دورة نتائج صريحة، وكفاءات محددة، وأنشطة تدريبية، ومشروع تخرجي تطبيقي.

مسارات الموضوع

تصفح حسب المسار

انتقل إلى المنطقة التي تهتم بها. يحتوي كل مسار على أدلة متعددة باللغة الإنجليزية البسيطة.

مكتبة كاملة

جميع الأدلة

117 من 1019 الأدلة المعروضة. تصفية حسب المسار أو البحث أعلاه.

الذكاء الاصطناعي الصوتي

فصل الجذع سبليتر

Spleeter هي أداة مفتوحة المصدر من Deezer تعمل على تقسيم الأغنية النهائية إلى مسارات منفصلة (غناء، وطبول، وبيس، والمزيد) باستخدام التعلم العميق.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

تقدير الملعب كريب

CREPE هو نموذج للتعلم العميق يقوم بتقدير التردد الأساسي (درجة الصوت) للإشارة الصوتية أحادية الصوت مباشرة من شكل موجتها الخام.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

مقاييس جودة الكلام PESQ وSTOI

PESQ وSTOI عبارة عن مقاييس موضوعية قياسية تسجل مدى جودة أصوات الكلام المعالجة ومدى فهمها، دون الحاجة إلى مستمعين بشريين.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

مصدر تصفية الترميز الصوتي والعالم

المشفر الصوتي هو أداة تفكك الكلام إلى وحداته الأساسية وتعيد بنائه.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

يعني تقييم نقاط الرأي

متوسط ​​نقاط الرأي (MOS) هو متوسط ​​تقييم من 1 إلى 5 من المستمعين البشريين، وهو يقيس مدى جودة الأصوات الصوتية المركبة أو المنقولة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

تحويل ثابت Q للصوت

تحويل Constant-Q (CQT) هو تحليل تردد يستخدم صناديق متباعدة لوغاريتميًا تتوافق مع النغمة الموسيقية، بدلاً من الصناديق المتباعدة بشكل متساوٍ...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

ميزات Filterbank وPLP

إن ميزات Filterbank وPerceptual Linear Prediction (PLP) هي طرق لتلخيص إشارة الكلام إلى أرقام مدمجة ذات معنى إدراكي يمكن تشكيلها...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

StyleTTS 2 نمط الانتشار

StyleTTS 2 هو نموذج لتحويل النص إلى كلام يتعامل مع "أسلوب" الصوت - النغمة والعاطفة وجرس المتحدث - كمتغير عشوائي تم أخذ عينات منه باستخدام نموذج الانتشار...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

FastPitch Pitch-Controlled TTS

FastPitch هو نموذج سريع وغير رجعي لتحويل النص إلى كلام يتنبأ بوضوح بطبقة الصوت (التردد الأساسي) لكل رمز إدخال، مما يتيح لك...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

إنشاء الكلام المطابق لتدفق صندوق الصوت

Voicebox هو نموذج توليد الكلام الموجه بالنص الخاص بـ Meta والذي تم تدريبه بهدف مطابقة التدفق "لملء" الصوت المقنع، مما يسمح لنموذج واحد بإجراء صوت بدون لقطة...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

تحدي قمع الضوضاء العميقة

تحدي منع الضوضاء العميقة (DNS) عبارة عن مسابقة تديرها Microsoft وتدفع الباحثين إلى بناء شبكات عصبية تعمل على تجريد الضوضاء الخلفية...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

الطرح الطيفي وتصفية وينر

يعد الطرح الطيفي وتصفية Wiener من الأدوات الكلاسيكية المستخدمة في مرحلة ما قبل التعلم العميق لتقليل الضوضاء.

2 دقيقة قراءةاقرأ

هل انتهيت من القراءة؟ اثبت ذلك.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 5 of 10 | AI Understanding