Signal2026-06-29
arXiv

Can LLMs Judge Better Than They Generate? Evaluating Task Asymmetry, Mechanistic Interpretability and Transferability for In-Context QA

Part of

Advances In Deep Learning Frameworks