Revisiting Complete Reasoning Traces for Post-Training Paper • 2609.07103 • Published 10 days ago • 23
Beneath the Surface of Chains-of-Thought: A Mechanistic Interpretation of Reasoning Operations in LLMs Paper • 2609.04753 • Published 13 days ago • 17
On-Policy Delta Distillation for Multilingual Math Reasoning Paper • 2608.05802 • Published Aug 6 • 33
What Defines Good Reasoning in LLMs? Dissecting Reasoning Steps with Multi-Aspect Evaluation Paper • 2510.20603 • Published Oct 23, 2025
MuCo: Multi-turn Contrastive Learning for Multimodal Embedding Model Paper • 2602.06393 • Published Feb 6 • 5
Similarity of Neural Architectures using Adversarial Attack Transferability Paper • 2210.11407 • Published Oct 20, 2022
Revisiting Complete Reasoning Traces for Post-Training Paper • 2609.07103 • Published 10 days ago • 23
Beneath the Surface of Chains-of-Thought: A Mechanistic Interpretation of Reasoning Operations in LLMs Paper • 2609.04753 • Published 13 days ago • 17