أسس الذكاء الاصطناعي
افهم ما هو الذكاء الاصطناعي، وكيف تتعلم الأنظمة، وأين تفشل، وكيف تحكم على الادعاءات دون مبالغة.
مكتبة الذكاء الاصطناعي المجانية
117 أدلة باللغة الإنجليزية البسيطة، ومسارات تعليمية منظمة، ومكتبة مفتوحة - تم إنشاؤها بواسطة منظمة غير ربحية مستقلة 501(c)(3) حتى يتمكن أي شخص من فهم الذكاء الاصطناعي الحديث.
ابدأ هنا
تتضمن كل دورة نتائج صريحة، وكفاءات محددة، وأنشطة تدريبية، ومشروع تخرجي تطبيقي.
افهم ما هو الذكاء الاصطناعي، وكيف تتعلم الأنظمة، وأين تفشل، وكيف تحكم على الادعاءات دون مبالغة.
استخدم الذكاء الاصطناعي بشكل منتج مع حماية الخصوصية، والتحقق من المخرجات، والحفاظ على المساءلة البشرية.
قيم حالات استخدام مكان العمل، وتشغيل تجارب آمنة، وقياس القيمة، والتواصل مع التغييرات بمسؤولية.
حلل أنظمة الذكاء الاصطناعي من خلال الحقوق، والعدالة، والحوكمة، والسلامة، ونتائج المصلحة العامة.
فهم نماذج اللغة، والاسترجاع، والوكلاء، والتقييم، والتكلفة، وضمانات النشر من خلال تصميم النظام العملي.
مسارات الموضوع
انتقل إلى المنطقة التي تهتم بها. يحتوي كل مسار على أدلة متعددة باللغة الإنجليزية البسيطة.
مكتبة كاملة
117 من 1019 الأدلة المعروضة. تصفية حسب المسار أو البحث أعلاه.
Mimi عبارة عن برنامج ترميز صوتي عصبي يضغط الكلام إلى تدفق صغير من الرموز المنفصلة في الوقت الفعلي، بحيث تتمكن نماذج الذكاء الاصطناعي من الاستماع والتحدث بصوت منخفض جدًا.
الذكاء الاصطناعي الصوتيالاستماع والحضور والتهجئة (LAS) هي شبكة عصبية بارزة تم إنشاؤها في عام 2015 تقوم بنسخ الكلام مباشرة إلى أحرف، دون الحاجة إلى نطق يدوي...
الذكاء الاصطناعي الصوتيSpecAugment عبارة عن طريقة بسيطة ولكنها فعالة لزيادة البيانات تعمل على إخفاء وتشويه المخطط الطيفي للكلام لجعل نماذج التعرف أكثر قوة.
الذكاء الاصطناعي الصوتييستخدم وضع العلامات التلقائي على الموسيقى التعلم الآلي للاستماع إلى أغنية وإرفاق تسميات وصفية تلقائيًا مثل النوع والمزاج والآلات الموسيقية والإيقاع.
الذكاء الاصطناعي الصوتييعيد نقل الجرس تشكيل "لون النغمة" للصوت بحيث تبدو إحدى الآلات وكأنها أخرى، مما يحول اللحن الطنان إلى كمان أو خط بوق...
الذكاء الاصطناعي الصوتييقوم تصنيف المشهد الصوتي (ASC) بتدريب الآلات على التعرف على البيئة التي تم فيها التسجيل، شارع مزدحم، حديقة هادئة، قطار، مقهى...
الذكاء الاصطناعي الصوتيNVIDIA Riva عبارة عن SDK مُسرّع بواسطة GPU لإنتاج الكلام AI (ASR، TTS، والترجمة)، في حين أن NeMo هي مجموعة أدوات مفتوحة المصدر للتدريب والضبط الدقيق...
الذكاء الاصطناعي الصوتيDeepSpeech هو نموذج شامل للتعرف على الكلام قدمته شركة Baidu في عام 2014 والذي يقوم بتعيين ميزات الصوت الخام مباشرة إلى النص باستخدام شبكة عصبية متكررة.
الذكاء الاصطناعي الصوتيناقلات X هي بصمات رقمية ثابتة الطول لصوت المتحدث تنتجها شبكة عصبية، تُستخدم لمعرفة من يتحدث بغض النظر عما يقوله.
الذكاء الاصطناعي الصوتيGlow-TTS هو نموذج لتحويل النص إلى كلام يتعلم كيفية محاذاة النص مع الكلام من تلقاء نفسه باستخدام خدعة بحث ذكية، مما يلغي الحاجة إلى أداة محاذاة منفصلة.
الذكاء الاصطناعي الصوتيParallel WaveGAN عبارة عن مشفر صوتي عصبي سريع يحول مخطط طيفي mel إلى شكل موجة صوتية خام باستخدام GAN صغير، مما يؤدي إلى إنشاء جميع العينات مرة واحدة.
الذكاء الاصطناعي الصوتيWaveGlow هو مشفر صوتي عصبي قائم على التدفق من NVIDIA يقوم بتجميع أشكال موجية للكلام من مخططات طيفية mel في مسار واحد دون انحدار ذاتي.
تحقق مما تعلمته من خلال اختبار حول الموضوع، ثم استكشف دوراتنا المنظمة أو اعمل للحصول على شهادة. يبقى كل دليل مجانيًا للقراءة.