arxiv:2608.00220
Shaohang Wei
SylvainWei
AI & ML interests
NLP, LLM
Recent Activity
liked a model 9 days ago
Accio-Lab/Metis-8B-ColdStart authored a paper about 1 month ago
Verifier-Induced Support Reshaping in On-Policy Optimization authored a paper about 1 month ago
Experience Augmented Policy Optimization for LLM Reasoning