Back to papers
June 26, 2026cs.CLcs.AI

Can LLMs Judge Better Than They Generate? Evaluating Task Asymmetry, Mechanistic Interpretability and Transferability for In-Context QA

Categories

cs.CL, cs.AI