Un artículo propone "lecciones" recuperadas para mejorar el razonamiento espacial en modelos de visión y lenguaje congelados
Una preimpresión de arXiv describe Spatial Memory Agent, que almacena experiencia verificada como lecciones de texto recuperadas en el momento de la inferencia, afirmando ganancias en cinco puntos de referencia espaciales y cuatro modelos de visión y lenguaje sin cambiar los pesos del modelo. Está bajo revisión; su resumen no menciona puntos de referencia, modelos base o márgenes.