क्या हुआ?
सैन फ्रांसिस्को स्थित क्रिएटिव एआई टूलिंग स्टार्टअप ओपनआर्ट ने ओपनआर्ट एरेना लॉन्च किया, जो एक सार्वजनिक बेंचमार्किंग प्लेटफॉर्म है, जो उपयोगकर्ताओं को एकल समग्र स्कोर पर भरोसा करने के बजाय विशिष्ट मल्टीमीडिया नौकरियों के लिए सर्वश्रेष्ठ एआई मॉडल का चयन करने में मदद करने के लिए डिज़ाइन किया गया है। प्लेटफ़ॉर्म फिल्म निर्माण, ई-कॉमर्स, ग्राफिक डिज़ाइन, मोशन डिज़ाइन, वीडियो संपादन और लिप सिंक सहित कार्यों के लिए मॉडल रैंकिंग को उपयोग-केस बोर्डों में विभाजित करता है। यह ब्रैडली-टेरी सांख्यिकीय मॉडल का उपयोग करके प्राथमिकताओं को एकत्रित करते हुए, रचनात्मक चिकित्सकों और 'टेस्टमेकर्स' के एक समूह से अंधे जोड़ीवार मूल्यांकन का उपयोग करता है। शुरुआती नतीजों से पता चलता है कि बाइटडांस का सीडांस 2.5 समग्र वीडियो बोर्ड में अग्रणी है, जबकि अलीबाबा का वान 3.0 वीडियो संपादन में पहले स्थान पर है। छवि निर्माण के लिए, OpenAI का GPT इमेज 2 ग्राफिक डिजाइन और संपादन में अग्रणी है, जबकि अलीबाबा का सीड्रीम 5.0 प्रो समग्र छवि बोर्ड में शीर्ष पर है। कंपनी मॉडल ट्यूनिंग को रोकने के लिए सक्रिय मूल्यांकन संकेतों को निजी रखते हुए अपनी कार्यप्रणाली और प्रॉम्प्ट सेट का हिस्सा प्रकाशित करने की योजना बना रही है।
ओपनआर्ट, पूर्व गूगलर्स कोको माओ और जॉन क़ियाओइस द्वारा सह-स्थापित, ने इस सवाल का जवाब देने के लिए ओपनआर्ट एरिना लॉन्च किया कि विशिष्ट मीडिया नौकरियों के लिए कौन सा एआई मॉडल सबसे अच्छा है। प्लेटफ़ॉर्म में छवि और वीडियो निर्माण के लिए अलग-अलग लीडरबोर्ड हैं, जिन्हें फिल्म निर्माण, ई-कॉमर्स, ग्राफिक डिज़ाइन, मोशन डिज़ाइन, वीडियो संपादन और लिप सिंक जैसे उपयोग के मामलों के अनुसार वर्गीकृत किया गया है।
बेंचमार्किंग प्रक्रिया में प्रत्येक बोर्ड के लिए क्यूरेटेड प्रॉम्प्ट सेट से आउटपुट तैयार करना और उन्हें मॉडल लेबल के बिना मूल्यांकनकर्ताओं के सामने प्रस्तुत करना शामिल है। न्यायाधीश साथ-साथ विकल्प चुनते हैं, और ओपनआर्ट ब्रैडली-टेरी सांख्यिकीय मॉडल का उपयोग करके इन प्राथमिकताओं को एकत्रित करता है। जजिंग पूल में नामांकित चिकित्सकों के साथ एक क्रिएटिव एक्सपर्ट काउंसिल और उपयोगकर्ताओं और रचनात्मक समुदायों से भर्ती किए गए लगभग 800 से 1,000 'टेस्टमेकर्स' का एक बड़ा समूह शामिल है।
प्रारंभिक वीडियो रैंकिंग में, बाइटडांस का मालिकाना सीडांस 2.5 1,081 के स्कोर के साथ समग्र बोर्ड में सबसे आगे है, इसके बाद अलीबाबा का वान 3.0 1,004 के साथ और बाइटडांस का सीडांस 2.0 1,000 के साथ दूसरे स्थान पर है। सीडांस 2.5 फिल्म, मोशन डिजाइन और लिप सिंक में भी पहले स्थान पर है, जबकि वान 3.0 सीडांस 2.5 के 1,033 की तुलना में 1,034 के स्कोर के साथ वीडियो संपादन में सबसे आगे है।
छवि निर्माण के लिए, परिणाम अधिक खंडित हैं। OpenAI की GPT इमेज 2 ग्राफिक डिजाइन और इमेज एडिटिंग में पहले स्थान पर है, जबकि अलीबाबा का सीड्रीम 5.0 प्रो फिल्म-उन्मुख इमेजरी और ई-कॉमर्स में अग्रणी है। सीड्रीम 5.0 प्रो भी समग्र छवि बोर्ड में 1,010 के स्कोर के साथ शीर्ष पर है, जो जीपीटी इमेज 2 से थोड़ा आगे है। विशेष रूप से, अलीबाबा का वान 3.0 ओपन सोर्स के रूप में वर्णित एकमात्र प्रमुख शीर्ष-तीन प्रवेशकर्ता है, हालांकि इसकी वर्तमान सार्वजनिक रिलीज में अभी तक स्व-होस्टिंग के लिए डाउनलोड करने योग्य मॉडल वजन शामिल नहीं है।
ओपनआर्ट ने कहा कि वह लॉन्च के समय अपनी कार्यप्रणाली और प्रॉम्प्ट सेट का हिस्सा प्रकाशित करेगा, लेकिन मॉडलों के बेंचमार्क के अनुरूप होने के जोखिम को कम करने के लिए कुछ सक्रिय मूल्यांकन संकेतों को निजी रखेगा। कंपनी का लक्ष्य एरिना को रचनात्मक कार्यों के लिए एआई मॉडल के चयन के लिए एक मान्यता प्राप्त उद्योग मानक बनाना है।
स्रोत विवरण: venturebeat.com ↗
यह क्यों मायने रखता है?
यह लॉन्च उद्यमों और रचनात्मक टीमों के लिए एक महत्वपूर्ण समस्या का समाधान करता है: तेजी से बढ़ते और खंडित बाजार के बीच इष्टतम एआई मॉडल का चयन करने की कठिनाई। विशिष्ट कार्य फ़ंक्शन द्वारा प्रदर्शन को विभाजित करके, ओपनआर्ट एरिना सामान्य लीडरबोर्ड की तुलना में अधिक कार्रवाई योग्य मार्गदर्शन प्रदान करता है, जो विशिष्ट क्षेत्रों में एक मॉडल की ताकत को अस्पष्ट कर सकता है। यह जेनेरिक एआई अपनाने वाले व्यवसायों के लिए विशेष रूप से प्रासंगिक है, जहां मॉडल चयन अक्सर पहली बड़ी बाधा होती है। बेंचमार्क मालिकाना एपीआई-आधारित मॉडल और ओपन-सोर्स विकल्पों के बीच व्यापार-बंद पर भी प्रकाश डालता है, जो डेटा रेजिडेंसी, लागत और तैनाती नियंत्रण पर निर्णयों को प्रभावित करता है। जबकि समान बेंचमार्क मौजूद हैं, ओपनआर्ट का ध्यान बारीक, कार्य-विशिष्ट रचनात्मक वर्कफ़्लोज़ पर केंद्रित है जो पेशेवर रचनात्मक उत्पादन के लिए एक विशिष्ट मूल्य प्रस्ताव प्रदान करता है।
ओपनआर्ट एरिना का लॉन्च एकल समग्र स्कोर के बजाय विशिष्ट कार्य कार्यों पर ध्यान केंद्रित करके एआई रचनात्मक मॉडल के मूल्यांकन के लिए अधिक सूक्ष्म दृष्टिकोण प्रदान करता है। यह उन उद्यमों और रचनात्मक टीमों के लिए महत्वपूर्ण है जिन्हें विशिष्ट उत्पादन कार्यों को सबसे सक्षम मॉडल तक ले जाने की आवश्यकता है, क्योंकि एक क्षेत्र में मजबूत मॉडल दूसरे में सर्वश्रेष्ठ नहीं हो सकता है।
बेंचमार्क मॉडल चयन के व्यावहारिक निहितार्थों पर प्रकाश डालता है, जिसमें मालिकाना एपीआई-आधारित मॉडल और ओपन-सोर्स विकल्पों के बीच व्यापार-बंद शामिल है। उदाहरण के लिए, जबकि बाइटडांस का सीडांस 2.5 वीडियो प्रदर्शन में अग्रणी है, यह एक मालिकाना मॉडल है, जबकि अलीबाबा का वान 3.0 खुला स्रोत है लेकिन स्व-होस्टिंग के लिए डाउनलोड करने योग्य वजन का अभाव है। यह अंतर व्यवसायों के लिए परिनियोजन नियंत्रण, डेटा रेजिडेंसी और स्वामित्व की कुल लागत को प्रभावित करता है।
ओपनआर्ट एरिना जेनेरिक एआई को अपनाने वाली कंपनियों के लिए एक आम चुनौती का समाधान करता है: तेजी से बढ़ते बाजार से सही मॉडल चुनने की कठिनाई। कार्य-विशिष्ट रैंकिंग प्रदान करके, प्लेटफ़ॉर्म कार्रवाई योग्य मार्गदर्शन प्रदान करता है जो रचनात्मक टीमों को सूचित निर्णय लेने में मदद कर सकता है और संभावित रूप से उनके एआई-सहायता प्राप्त उत्पादन वर्कफ़्लो की दक्षता और गुणवत्ता में सुधार कर सकता है।
बेंचमार्क एआई मूल्यांकन के मानकीकरण के बारे में व्यापक बातचीत में भी योगदान देता है। जबकि कॉन्ट्रा लैब्स और आर्टिफिशियल एनालिसिस जैसे अन्य प्लेटफ़ॉर्म समान कार्य-विशिष्ट रैंकिंग प्रदान करते हैं, ओपनआर्ट का ग्रैन्युलर रचनात्मक वर्कफ़्लो पर ध्यान केंद्रित करना और एक वाणिज्यिक रचनात्मक प्लेटफ़ॉर्म के साथ इसका एकीकरण इसे व्यापक रूप से मान्यता प्राप्त उद्योग मानक बनने में प्रतिस्पर्धात्मक बढ़त दे सकता है।
इंटरैक्टिव तंत्र: यह वास्तव में कैसे काम करता है
इस विकास के पीछे अंतर्निहित प्रौद्योगिकी का अंतःक्रियात्मक रूप से अन्वेषण करें।
Which component of an AI application is the machine-learning model itself?
आगे क्या देखना है
मॉनिटर करें कि नए मॉडल जारी होने पर ओपनआर्ट एरिना की रैंकिंग कैसे विकसित होती है और क्या प्लेटफ़ॉर्म रचनात्मक एआई खरीद के लिए एक वास्तविक उद्योग मानक बन जाता है। संपूर्ण कार्यप्रणाली और शीघ्र सेटों के प्रकाशन पर नज़र रखें, जो परिणामों के स्वतंत्र सत्यापन की अनुमति देगा। इसके अतिरिक्त, देखें कि कॉन्ट्रा लैब्स के ह्यूमन क्रिएटिविटी बेंचमार्क और आर्टिफिशियल एनालिसिस इमेज एरेना जैसे प्रतिस्पर्धी बेंचमार्क ओपनआर्ट के लॉन्च पर कैसे प्रतिक्रिया देते हैं, जिससे संभावित रूप से रचनात्मक एआई क्षमताओं के मूल्यांकन के लिए अधिक मानकीकृत दृष्टिकोण की ओर अग्रसर होता है।
बेंचमार्क के परिणामों के स्वतंत्र सत्यापन के लिए ओपनआर्ट की पूर्ण कार्यप्रणाली और त्वरित सेट का प्रकाशन महत्वपूर्ण होगा। मूल्यांकन प्रक्रिया में पारदर्शिता उपयोगकर्ताओं के बीच विश्वास बनाने में मदद करेगी और यह सुनिश्चित करेगी कि रैंकिंग मॉडल के प्रदर्शन को सटीक रूप से प्रतिबिंबित करे।
नए मॉडल जारी होने पर ओपनआर्ट एरिना की रैंकिंग का विकास प्लेटफ़ॉर्म की प्रासंगिकता और सटीकता का एक महत्वपूर्ण संकेतक होगा। समय के साथ रैंकिंग कैसे बदलती है इसकी निगरानी करने से एआई रचनात्मक मॉडल के तेजी से विकास और इन परिवर्तनों को पकड़ने में बेंचमार्क की प्रभावशीलता के बारे में जानकारी मिलेगी।
कॉन्ट्रा लैब्स के ह्यूमन क्रिएटिविटी बेंचमार्क और आर्टिफिशियल एनालिसिस के इमेज एरिना जैसे प्रतिस्पर्धी बेंचमार्क से प्रतिक्रिया महत्वपूर्ण होगी। ओपनआर्ट के लॉन्च के जवाब में ये प्लेटफ़ॉर्म अपनी कार्यप्रणाली को समायोजित कर सकते हैं या नई सुविधाएँ लॉन्च कर सकते हैं, जिससे संभावित रूप से रचनात्मक एआई क्षमताओं के मूल्यांकन के लिए अधिक मानकीकृत और व्यापक दृष्टिकोण प्राप्त होगा।
उद्यमों और रचनात्मक पेशेवरों द्वारा ओपनआर्ट एरिना को अपनाना इसकी सफलता का एक प्रमुख संकेतक होगा। यदि प्लेटफ़ॉर्म मॉडल चयन के लिए व्यापक रूप से उपयोग किया जाने वाला उपकरण बन जाता है, तो यह एआई रचनात्मक मॉडल के विकास और बेंचमार्क पर अपने प्रदर्शन को अनुकूलित करने की मांग करने वाले एआई प्रदाताओं की रणनीतियों को प्रभावित कर सकता है।