De CoVA-SFT-dataset heeft tot doel multimodale AI te leren redeneren via visuele abstracties
Onderzoekers introduceren CoVA-SFT, een dataset van 51.900 multimodale voorbeelden en meer dan 222.000 redeneerstappen, die rapporteren dat verfijnde modellen de prestaties van geïnterlinieerde gedachteketenbasislijnen ten opzichte van de bijbehorende benchmark meer dan verdubbelden.