अध्ययन से पता चलता है कि दृष्टि-भाषा मॉडल कुछ-शॉट अनुकूलन में एक मॉडल-क्लास छत तक पहुंच जाते हैं
एक नया arXiv अध्ययन रिपोर्ट करता है कि पाठ और छवि प्रोटोटाइप के बीच मिश्रण को ट्यून करना कुछ-शॉट दृष्टि-भाषा मॉडल सटीकता पर मुख्य सीमा नहीं है। 4,800 मूल्यांकन कोशिकाओं में फैले प्रयोगों में, सत्यापन-मुक्त रैखिक जांच ने परीक्षण-सेट जानकारी के साथ चयनित मिश्रण से भी बेहतर प्रदर्शन किया।