مكتبة الذكاء الاصطناعي المجانية

الذكاء الاصطناعي الصوتي أدلةمجانا إلى الأبد.

117 أدلة باللغة الإنجليزية البسيطة، ومسارات تعليمية منظمة، ومكتبة مفتوحة - تم إنشاؤها بواسطة منظمة غير ربحية مستقلة 501(c)(3) حتى يتمكن أي شخص من فهم الذكاء الاصطناعي الحديث.

117أدلة مجانية
1مسارات الموضوع
~2 minلكل دليل
~4hوقت القراءة

ابدأ هنا

خمسة الدورات القائمة على النتائج

تتضمن كل دورة نتائج صريحة، وكفاءات محددة، وأنشطة تدريبية، ومشروع تخرجي تطبيقي.

مسارات الموضوع

تصفح حسب المسار

انتقل إلى المنطقة التي تهتم بها. يحتوي كل مسار على أدلة متعددة باللغة الإنجليزية البسيطة.

مكتبة كاملة

جميع الأدلة

117 من 1019 الأدلة المعروضة. تصفية حسب المسار أو البحث أعلاه.

الذكاء الاصطناعي الصوتي

تشكيل الشعاع ومصفوفات الميكروفون

يستخدم Beamforming ميكروفونات متعددة للاستماع في الاتجاه المختار، مما يؤدي إلى تضخيم الصوت من الهدف مع قمع كل شيء آخر.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

انتشار الطيفي

Riffusion هو اختراق ذكي يولد الموسيقى من خلال معالجة الصوت كصورة: فهو يضبط نموذج الصورة Stable Diffusion لرسم مخططات طيفية، ثم...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

MusicLM: الرموز الدلالية والصوتية الهرمية

تعرف على كيفية استخدام Google MusicLM للرموز الدلالية والصوتية الهرمية، وSoundStream، وMuLan لتحويل المطالبات النصية إلى موسيقى متماسكة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

Noise2Noise تحسين الكلام

Noise2Noise عبارة عن خدعة تدريبية تتيح للنموذج تعلم كيفية إزالة الضوضاء دون رؤية مرجع نظيف على الإطلاق، وذلك من خلال التعلم من أزواج مختلفة الضوضاء...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

Conv-TasNet فصل المجال الزمني

Conv-TasNet عبارة عن شبكة عصبية تفصل الصوت المختلط (مثل شخصين يتحدثان في وقت واحد) من خلال العمل مباشرة على شكل موجة الصوت الخام بدلاً من ذلك...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

فصل RNN ثنائي المسار

Dual-Path RNN (DPRNN) عبارة عن بنية لفصل الصوت تعمل على تقسيم سلسلة طويلة جدًا من ميزات الصوت إلى أجزاء متداخلة قصيرة ومعالجتها...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

فتح وفصل الموسيقى

Open-Unmix (UMX) هو نظام تعليمي عميق مفتوح المصدر يقسم الأغنية إلى أجزائها: غناء، وطبول، وباس، وأدوات أخرى.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

الهمس محاذاة الكلمات ذات الطابع الزمني

تعمل محاذاة الكلمات الهامسة على تثبيت كل كلمة مكتوبة في وقت بداية ونهاية محددين في الصوت.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

وضع العلامات على الموسيقى مع المحولات

تستخدم علامات الموسيقى نماذج المحولات للاستماع إلى أغنية والتنبؤ بالتسميات الوصفية مثل النوع والمزاج والآلات الموسيقية والإيقاع.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

كشف البداية في الصوت

يكتشف اكتشاف البداية اللحظات الدقيقة التي تبدأ فيها النغمات أو الإيقاعات أو الأصوات في إشارة صوتية.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

MelGAN المشفر الصوتي التوليدي

MelGAN هو مشفر صوتي تلافيفي بالكامل قائم على GAN يحول مخططات طيفية mel إلى أشكال موجية صوتية خام في تمريرة واحدة سريعة للأمام.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي الصوتي

UnivNet مشفر صوتي متعدد الدقة

UnivNet هو مشفر صوتي لـ GAN يحكم على الصوت الناتج باستخدام مخططات طيفية متعددة محسوبة بدقة STFT مختلفة، مما يؤدي إلى زيادة وضوح التفاصيل عالية التردد.

2 دقيقة قراءةاقرأ

هل انتهيت من القراءة؟ اثبت ذلك.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.

Audio AI AI Guides — Page 6 of 10 | AI Understanding