الذكاء الاصطناعي في الإشراف على محتوى الفيديو
يقوم الذكاء الاصطناعي بمراجعة مقاطع الفيديو التي تم تحميلها وبثها مباشرة للكشف عن المواد الضارة مثل العنف أو العري أو خطاب الكراهية بشكل أسرع بكثير مما يستطيع المشرفون البشريون القيام به بمفردهم.
نظرة عامة
It matters because platforms receive hundreds of hours of video every minute, making manual review impossible at scale.
الغوص العميق
يعد الإشراف على الفيديو متعدد الوسائط: مقطع واحد يحمل الصور والحركة والصوت والنص الذي يظهر على الشاشة. تقوم الأنظمة باختبار الإطارات وتشغيل مصنفات الرؤية الحاسوبية لاكتشاف العري أو الأسلحة أو الدماء أو الرموز المتطرفة؛ ويقومون بتحليل الحركة عبر الإطارات للإبلاغ عن أعمال العنف؛ يقوم تحويل الكلام إلى نص بنسخ الصوت حتى تتمكن نماذج البرمجة اللغوية العصبية من اكتشاف خطاب الكراهية أو التهديدات؛ ويقوم التعرف البصري على الأحرف بقراءة النص المتراكب على الفيديو. إحدى التقنيات الحاسمة هي التجزئة: يتم تحويل مقاطع الفيديو الضارة المعروفة (مثل الدعاية الإرهابية أو مواد إساءة معاملة الأطفال) إلى بصمات أصابع رقمية بحيث يتم حظر إعادة التحميل على الفور دون إعادة تحليل. نظرًا لأن السياق مهم، فإن التقرير الإخباري الذي يظهر العنف يختلف عن تمجيده، وتستخدم معظم المنصات الذكاء الاصطناعي لفرز الحالات وتحديد الأولويات، ثم توجيه الحالات الغامضة إلى المراجعين البشريين.
البصيرة الفنية
تؤدي التجزئة الإدراكية (مثل PhotoDNA وPDQ للصور، بالإضافة إلى متغيرات تجزئة الفيديو) إلى إنشاء بصمة قوية لتغيير الحجم أو إعادة الضغط أو التعديلات البسيطة، لذا فإن إعادة التحميل التي تم تغييرها قليلاً لا تزال تتطابق مع إدخال معروف سيئ في قواعد بيانات الصناعة المشتركة. بالنسبة للمحتوى الجديد، تعمل المصنفات العميقة على إطارات ومقاطع صوتية تم أخذ عينات منها، مما ينتج عنه درجات الثقة؛ يتم تصعيد العناصر القريبة فقط من حدود القرار إلى البشر، مما يبقي التكلفة ووقت الاستجابة تحت السيطرة عند مليارات التحميلات.
التأثير الاستراتيجي
خيارات البناء
يحدد التصميم على مستوى التطبيق ما إذا كان الذكاء الاصطناعي سيحسن النتائج الحقيقية.
الفريق وسير العمل
يؤدي التكامل الجيد لسير العمل إلى تحقيق مكاسب إنتاجية يمكن للمستخدمين الوثوق بها.
المخاطر والسلامة
تعمل حالات الاستخدام ذات النطاق الجيد على تقليل إجهاد التغيير ومخاطر التنفيذ.
مستقبل الذكاء الاصطناعي في الإشراف على محتوى الفيديو
تتجه النماذج نحو الفهم الحقيقي للفيديو، والتفكير في سرد مقطع كامل بدلاً من الإطارات المنعزلة، مما يساعد على فصل التوثيق عن التمجيد. يعد الإشراف على البث المباشر في الوقت الفعلي محورًا رئيسيًا بعد الإخفاقات البارزة. وفي الوقت نفسه، يعمل الذكاء الاصطناعي التوليدي على تسهيل إنتاج المحتوى المزيف العميق ومحتوى الإساءة الاصطناعية، لذا أصبح اكتشاف مقاطع الفيديو التي تم إنشاؤها بواسطة الذكاء الاصطناعي والتلاعب بها، بالإضافة إلى تصنيفات المصدر، أمرًا أساسيًا في أعمال الثقة والسلامة.
التنفيذ في العالم الحقيقي
يكتشف YouTube تلقائيًا ويقيد العمر أو يزيل العنف المصور والعري في التحميلات
Meta ومنصات أخرى تستخدم قواعد بيانات التجزئة المشتركة (عبر GIFCT) لمنع الدعاية الإرهابية المعروفة عبر الخدمات
يقوم TikTok بمسح البث المباشر في الوقت الفعلي تقريبًا لمقاطعة محتوى العري أو إيذاء النفس
تقوم المنصات بنسخ الصوت لالتقاط خطاب الكراهية والتهديدات المنطوقة في مقاطع الفيديو، وليس فقط إظهارها بشكل مرئي
المخاطر والدرابزين
يمكن أن تؤدي أتمتة عملية معطلة إلى تضخيم المشاكل الموجودة.
قد تقوم الفرق بالإفراط في أتمتة وإزالة الحكم البشري المطلوب.
يمكن أن تنحرف الجودة إذا لم يتم تقييم المخرجات بشكل مستمر.
خارطة طريق التنفيذ
قم بتخطيط سير العمل الحالي وحدد خطوة الاحتكاك الأعلى.
تحديد نقاط التفتيش البشرية قبل الأتمتة الكاملة.
تدريب المستخدمين على المطالبات ومسارات التصعيد ومعايير الجودة.
تتبع النتائج على مستوى المهمة لتأكيد القيمة المستدامة.
استمر في الاستكشاف
Free newsletter
Get the daily AI briefing
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Take the AI in Video Content Moderation quiz
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
الدليل التالي
الذكاء الاصطناعي في سلوك الشخصيات غير القابلة للعب في ألعاب الفيديو
الأسئلة المتداولة
What is AI in Video Content Moderation?
يقوم الذكاء الاصطناعي بمراجعة مقاطع الفيديو التي تم تحميلها وبثها مباشرة للكشف عن المواد الضارة مثل العنف أو العري أو خطاب الكراهية بشكل أسرع بكثير مما يستطيع المشرفون البشريون القيام به بمفردهم. وهذا مهم لأن المنصات تتلقى مئات الساعات من الفيديو كل دقيقة، مما يجعل المراجعة اليدوية مستحيلة على نطاق واسع.
لماذا يوصف الإشراف على الفيديو بأنه "متعدد الوسائط"؟
يجمع الفيديو بين عدة أنواع من الإشارات، لذا يحتاج الإشراف الفعال إلى عمل الرؤية وتحليل الحركة وتحويل الكلام إلى نص والتعرف الضوئي على الحروف معًا.
ما هي الميزة الرئيسية للتجزئة الإدراكية لمقاطع الفيديو الضارة المعروفة؟
تقوم التجزئة بإنشاء بصمة للمحتوى السيئ المعروف، بحيث يتم اكتشاف المطابقات على الفور، حتى بعد التعديلات البسيطة، دون إعادة تشغيل التحليل الكامل.
لماذا لا تزال المنصات تقوم بتوجيه العديد من الحالات إلى المراجعين البشريين؟
يقوم الذكاء الاصطناعي بفرز المحتوى وتسجيل النتائج، ولكن الحالات الغامضة التي تحتاج إلى حكم بشأن النية والسياق يتم تصعيدها إلى الأشخاص.
كيف يساهم تحويل الكلام إلى نص في الاعتدال؟
يمكن نطق المحتوى الضار بدلاً من عرضه، لذا فإن نسخ الصوت يسمح للنماذج النصية بالتقاطه.
ما الذي يجعل التجزئة الإدراكية قوية مقارنة بمطابقة النسخة التامة؟
تم تصميم التجزئات الإدراكية لتتحمل التعديلات الصغيرة، لذلك لا يمكن للقائمين بإعادة التحميل تجنب اكتشافهم من خلال تغييرات تافهة.