Signal2026-08-06
arXiv

Toward Skill-Native LLMs: Skill Entropy for Benchmarking and Training Long-Horizon Reasoning

Part of

Advanced Inverse Reward And Prompt Engineering