مكتبة الذكاء الاصطناعي المجانية

الذكاء الاصطناعي الصوتي أدلةمجانا إلى الأبد.

117 أدلة باللغة الإنجليزية البسيطة، ومسارات تعليمية منظمة، ومكتبة مفتوحة - تم إنشاؤها بواسطة منظمة غير ربحية مستقلة 501(c)(3) حتى يتمكن أي شخص من فهم الذكاء الاصطناعي الحديث.

117أدلة مجانية
1مسارات الموضوع
~2 minلكل دليل
~4hوقت القراءة

ابدأ هنا

خمسة الدورات القائمة على النتائج

تتضمن كل دورة نتائج صريحة، وكفاءات محددة، وأنشطة تدريبية، ومشروع تخرجي تطبيقي.

مسارات الموضوع

تصفح حسب المسار

انتقل إلى المنطقة التي تهتم بها. يحتوي كل مسار على أدلة متعددة باللغة الإنجليزية البسيطة.

مكتبة كاملة

جميع الأدلة

117 من 1019 الأدلة المعروضة. تصفية حسب المسار أو البحث أعلاه.

الذكاء الاصطناعي الصوتي

التسميات التوضيحية الصوتية

يُنشئ التسميات التوضيحية الصوتية جملة باللغة الطبيعية تصف محتوى مقطع صوتي، مثل "ينطلق بوق القطار أثناء عبوره معبرًا".

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

التعرف على الكلام الهمس

Whisper هو نظام التعرف التلقائي على الكلام مفتوح المصدر الخاص بـ OpenAI والذي يحول الصوت إلى نص عبر أكثر من 90 لغة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

واف2فيك 2.0

Wav2Vec 2.0 هو Meta نموذج الكلام الخاضع للإشراف الذاتي للذكاء الاصطناعي والذي يتعلم التمثيلات الصوتية القوية من التسجيلات الأولية غير المُسماة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

خطاب HuBERT الخاضع للإشراف الذاتي

HuBERT (Hidden-Unit BERT) هو Meta نموذج الكلام الخاضع للإشراف الذاتي للذكاء الاصطناعي والذي يتعلم من خلال التنبؤ بالوحدات الصوتية المجمعة للمقاطع المقنعة، على طراز BERT.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

مشفرات الصوت العصبية

المشفر الصوتي العصبي هو نموذج يحول التمثيل الصوتي المدمج، عادة مخطط طيفي ميل، إلى شكل موجة مسموعة فعلية.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

برامج ترميز الصوت العصبية

تستخدم برامج ترميز الصوت العصبية التعلم العميق لضغط الصوت إلى تدفقات صغيرة من الرموز المنفصلة وإعادة بنائها بدقة عالية.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

نماذج VALL-E ولغة الترميز

أعاد VALL-E صياغة تحويل النص إلى كلام كمشكلة في نمذجة اللغة عبر رموز ترميز الصوت، مما يتيح استنساخ الصوت من ثلاث ثوانٍ فقط من العينة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

OpenAI همس

Whisper هو نظام التعرف التلقائي على الكلام مفتوح المصدر الخاص بـ OpenAI والذي يقوم بنسخ وترجمة الصوت المنطوق عبر عشرات اللغات.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

النسخ التلقائي للموسيقى

يقوم النسخ التلقائي للموسيقى (AMT) بتحويل التسجيل الصوتي الخام للموسيقى إلى تدوين رمزي مثل النوتة الموسيقية أو MIDI أو لفافة البيانو.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

تتبع الإيقاع والإيقاع

تتبع الإيقاع والإيقاع هي مهمة العثور على النبض الثابت في الموسيقى: مكان سقوط كل نبضة ومدى سرعة تحرك الأغنية في عدد النبضات في الدقيقة (BPM).

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

البصمة الصوتية

تنشئ بصمة الصوت توقيعًا رقميًا مدمجًا ومقاومًا للضوضاء للصوت بحيث يمكن التعرف عليه لاحقًا، حتى من خلال ضجيج الخلفية...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

الموسيقي

Jukebox هي شبكة OpenAI العصبية لعام 2020 التي تولد صوتًا موسيقيًا خامًا - مكتملًا بأصوات الغناء والآلات وحتى كلمات الأغاني بأسلوب معين...

2 دقيقة قراءةاقرأ

هل انتهيت من القراءة؟ اثبت ذلك.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 8 of 10 | AI Understanding