مكتبة الذكاء الاصطناعي المجانية

الذكاء الاصطناعي البصري أدلةمجانا إلى الأبد.

133 أدلة باللغة الإنجليزية البسيطة، ومسارات تعليمية منظمة، ومكتبة مفتوحة - تم إنشاؤها بواسطة منظمة غير ربحية مستقلة 501(c)(3) حتى يتمكن أي شخص من فهم الذكاء الاصطناعي الحديث.

133أدلة مجانية
1مسارات الموضوع
~2 minلكل دليل
~4hوقت القراءة

ابدأ هنا

خمسة الدورات القائمة على النتائج

تتضمن كل دورة نتائج صريحة، وكفاءات محددة، وأنشطة تدريبية، ومشروع تخرجي تطبيقي.

مسارات الموضوع

تصفح حسب المسار

انتقل إلى المنطقة التي تهتم بها. يحتوي كل مسار على أدلة متعددة باللغة الإنجليزية البسيطة.

مكتبة كاملة

جميع الأدلة

133 من 1019 الأدلة المعروضة. تصفية حسب المسار أو البحث أعلاه.

الذكاء الاصطناعي البصري

التعرف البصري على الحروف

يعمل نظام التعرف الضوئي على الحروف (OCR) على تحويل صور النص - المستندات الممسوحة ضوئيًا، وصور اللافتات، وملفات PDF - إلى نص يمكن قراءته وتحريره بواسطة الآلة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

التدفق البصري

يقدر التدفق البصري كيفية تحرك كل بكسل بين إطارات الفيديو المتتالية، مما ينتج عنه خريطة كثيفة لمتجهات الحركة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

تقدير عمق أحادي

يتنبأ تقدير العمق أحادي العين بمدى بُعد كل بكسل عن صورة عادية واحدة - لا حاجة إلى كاميرا استريو أو مستشعر ليدار أو مستشعر عمق.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

نماذج الانتشار الكامن

تعمل نماذج الانتشار الكامنة على إنشاء صور عن طريق تشغيل عملية الانتشار في مساحة كامنة مضغوطة بدلاً من وحدات البكسل الأولية، مما يؤدي إلى خفض تكاليف الحوسبة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

كونترول نت

ControlNet عبارة عن وظيفة إضافية تمنح نماذج إنشاء الصور تحكمًا هيكليًا دقيقًا، مما يتيح لك توجيه الإخراج باستخدام الحواف أو الوضعيات أو خرائط العمق أو الخربشات.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

إرشادات خالية من المصنف

التوجيه الخالي من المصنف هو الأسلوب الذي يجعل نماذج الانتشار تتبع مطالبتك فعليًا، وتستبدل بعض التنوع بالتزام أقوى بكثير.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

البطولات الاربع البصرية

يتيح Visual SLAM للكاميرا المتحركة إنشاء خريطة لمساحة غير معروفة مع تتبع موقعها داخل تلك الخريطة في نفس الوقت.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

Sora وتحويل النص إلى فيديو

Sora هو نموذج تحويل النص إلى فيديو الخاص بـ OpenAI والذي يحول المطالبة المكتوبة إلى مقطع فيديو قصير وعالي الدقة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

نماذج انتشار الفيديو

تولد نماذج نشر الفيديو صورًا متحركة عن طريق تحويل الضوضاء العشوائية تدريجيًا إلى إطارات متماسكة، مما يؤدي إلى توسيع فكرة الانتشار من الصور إلى الوقت.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

إنشاء النص إلى ثلاثي الأبعاد

يحول إنشاء تحويل النص إلى ثلاثي الأبعاد مطالبة مكتوبة مثل "كرسي بذراعين جلدي عتيق" إلى نموذج ثلاثي الأبعاد كامل يمكنك تدويره وإضاءته وإسقاطه في لعبة أو مشهد.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

التقديم المتباين

العرض القابل للتمييز يجعل عملية تحويل مشهد ثلاثي الأبعاد إلى صورة ثنائية الأبعاد قابلة للتمييز بالكامل، بحيث يمكنك حساب التدرجات من وحدات البكسل المعروضة...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

هندسة يو نت

U-Net عبارة عن شبكة عصبية تلافيفية على شكل حرف "U" تتفوق في إنتاج مخرجات دقيقة بالبكسل، وهي في الأصل مخصصة لتجزئة الصور الطبية الحيوية.

2 دقيقة قراءةاقرأ

هل انتهيت من القراءة؟ اثبت ذلك.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.