Researchers Introduce OmniLens for Large-Scale Language Model Interpretability
A new arXiv paper describes OmniLens, a lower-cost method for examining internal signals across entire large language models and identifying where behaviors appear versus where interventions work.