Information Abundance Paradox: Long-Context Training Undermines Parametric Knowledge Paper • 2608.12218 • Published 11 days ago • 6
HarnessOpt-Bench: Evaluating LLMs at Harness Optimization Paper • 2608.06301 • Published 17 days ago • 35
Trust Functions: Near-Lossless Weak-to-Strong Generalization by Learning When to Trust the Weak Teacher Paper • 2606.01000 • Published May 31 • 6