مكتبة الذكاء الاصطناعي المجانية

الذكاء الاصطناعي البصري أدلةمجانا إلى الأبد.

133 أدلة باللغة الإنجليزية البسيطة، ومسارات تعليمية منظمة، ومكتبة مفتوحة - تم إنشاؤها بواسطة منظمة غير ربحية مستقلة 501(c)(3) حتى يتمكن أي شخص من فهم الذكاء الاصطناعي الحديث.

133أدلة مجانية
1مسارات الموضوع
~2 minلكل دليل
~4hوقت القراءة

ابدأ هنا

خمسة الدورات القائمة على النتائج

تتضمن كل دورة نتائج صريحة، وكفاءات محددة، وأنشطة تدريبية، ومشروع تخرجي تطبيقي.

مسارات الموضوع

تصفح حسب المسار

انتقل إلى المنطقة التي تهتم بها. يحتوي كل مسار على أدلة متعددة باللغة الإنجليزية البسيطة.

مكتبة كاملة

جميع الأدلة

133 من 1019 الأدلة المعروضة. تصفية حسب المسار أو البحث أعلاه.

الذكاء الاصطناعي البصري

تنسيق الصور وتركيبها

تعمل ميزة تناغم الصورة تلقائيًا على ضبط كائن المقدمة الملصق بحيث يتطابق لونه وإضاءته ودرجته مع الخلفية الجديدة، مما يجعل العناصر المركبة تبدو حقيقية.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

SDXL والانتشار المتتالي

SDXL هو نموذج تحويل النص إلى صورة عالي الدقة من Stability AI والذي يجمع بين مولد أساسي قوي ومصفاة، في حين أن سلاسل الانتشار المتتالية متعددة…

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

GLIGEN الجيل الأرضي

يتيح لك GLIGEN (إنشاء اللغة المؤرضة إلى الصورة) التحكم الدقيق في مكان ظهور الكائنات في الصورة التي تم إنشاؤها عن طريق تغذية المربعات المحيطة بالنموذج...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

محول T2I للتحكم في الانتشار متعدد الشروط

تعلم محول T2I للتحكم في الانتشار متعدد الشروط: كيف يوجه الانتشار المستقر مع الحواف والعمق والوضعية والظروف الأخرى باستخدام خفيف الوزن...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

انعكاس النص الخالي

إن انعكاس النص الخالي هو أسلوب يتيح لك تحرير صورة حقيقية باستخدام نموذج نشر يعتمد على النص مثل Stable Diffusion مع الاحتفاظ بكل ما تريد...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

ضبط مخصص متعدد المفاهيم

يُعد Custom Diffusion طريقة ضبط دقيقة وخفيفة الوزن تُعلم نموذج تحويل النص إلى صورة مفاهيم شخصية جديدة، مثل كلبك أو كرسي معين، من مجرد...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

المزج الكامن واستيفاء الصور

يمزج المزج الكامن الصور عن طريق دمج تمثيلاتها المضغوطة داخل المساحة الكامنة للنموذج بدلاً من حساب متوسط وحدات البكسل الأولية.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

نماذج الرؤية واللغة والعمل للروبوتات

نماذج الرؤية واللغة والعمل (VLA) عبارة عن شبكات عصبية كبيرة تلتقط صور الكاميرا بالإضافة إلى تعليمات مكتوبة وتخرج أوامر محرك الروبوت مباشرة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

سياسة الانتشار للتحكم في الروبوت

تطبق سياسة الانتشار نفس فكرة تقليل الضوضاء وراء مولدات الصور مثل Stable Diffusion على التحكم في الروبوت: بدلاً من التنبؤ بإجراء تالٍ واحد...

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

تحويل النص إلى فيديو من فيديو

Make-A-Video هو نظام Meta لعام 2022 الذي يحول المطالبة النصية إلى مقطع فيديو قصير دون التدريب على أزواج نصية وفيديو مصنفة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

Imagen Video Cascades

Imagen Video هو نظام تحويل النص إلى فيديو لعام 2022 من Google والذي يقوم بإنشاء مقطع من خلال سلسلة من سبعة نماذج نشر، يضيف كل منها المزيد من الإطارات أو المزيد من الدقة.

2 دقيقة قراءةاقرأ
الذكاء الاصطناعي البصري

CogVideo وCogVideoX

كان CogVideo (2022) أول نموذج مفتوح واسع النطاق لتحويل النص إلى فيديو، وCogVideoX (2024) هو خليفته مفتوح المصدر الأكثر قدرة بكثير من Tsinghua/Zhipu AI.

2 دقيقة قراءةاقرأ

هل انتهيت من القراءة؟ اثبت ذلك.

Check what you learned with a topic quiz, then explore our structured courses or work toward a certificate. Every guide stays free to read.