Los investigadores presentan OmniLens para la interpretabilidad de modelos de lenguaje a gran escala
Un nuevo artículo de arXiv describe OmniLens, un método de menor costo para examinar señales internas en modelos de lenguaje grandes y completos e identificar dónde aparecen los comportamientos y dónde funcionan las intervenciones.