La alineación es todo lo que necesita: capacitación sin instrucciones para modelos de audiolenguaje general
Un nuevo enfoque para entrenar modelos de lenguajes grandes multimodales (MLLM) elimina la necesidad de una supervisión extensa de tareas específicas.