2 28 1

Jiarui Yao

FlippyDora

AI & ML interests

None yet

Recent Activity

updated a model 2 days ago

CorrectKLinRL/Qwen3-4B-Base-dapo_filter-grpo-noKL

published a model 2 days ago

CorrectKLinRL/Qwen3-4B-Base-dapo_filter-grpo-noKL

updated a model 2 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-grpo-noKL

View all activity

Organizations

updated a model 2 days ago

CorrectKLinRL/Qwen3-4B-Base-dapo_filter-grpo-noKL

4B • Updated 2 days ago • 64

published a model 2 days ago

CorrectKLinRL/Qwen3-4B-Base-dapo_filter-grpo-noKL

4B • Updated 2 days ago • 64

updated a model 2 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-grpo-noKL

2B • Updated 2 days ago • 110

published a model 2 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-grpo-noKL

2B • Updated 2 days ago • 110

updated a model 4 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-prm-eta100-Advorm-stepsplit-none

2B • Updated 4 days ago • 51

published a model 4 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-prm-eta100-Advorm-stepsplit-none

2B • Updated 4 days ago • 51

updated a model 4 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-grpo-useKL_True-KLlossCoef1e-3

2B • Updated 4 days ago • 163

published 2 models 4 days ago

CorrectKLinRL/Qwen3-1.7B-Base-dapo_filter-grpo-useKL_True-KLlossCoef1e-3

2B • Updated 4 days ago • 163

FlippyDora/CorrectKLinRL

Updated 4 days ago

upvoted a paper 7 days ago

Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling

Paper • 2604.28185 • Published 8 days ago • 86

upvoted a paper 9 days ago

Recursive Multi-Agent Systems

Paper • 2604.25917 • Published 10 days ago • 259

authored 5 papers 16 days ago

EscapeBench: Towards Advancing Creative Intelligence of Language Model Agents

Paper • 2412.13549 • Published Dec 18, 2024

GAR: Generative Adversarial Reinforcement Learning for Formal Theorem Proving

Paper • 2510.11769 • Published Oct 13, 2025 • 26

ERA: Transforming VLMs into Embodied Agents via Embodied Prior Learning and Online Reinforcement Learning

Paper • 2510.12693 • Published Oct 14, 2025 • 28

Supervised Fine-Tuning versus Reinforcement Learning: A Study of Post-Training Methods for Large Language Models

Paper • 2603.13985 • Published Mar 14 • 10

AgentSPEX: An Agent SPecification and EXecution Language

Paper • 2604.13346 • Published 24 days ago • 162

upvoted a paper 16 days ago

AgentSPEX: An Agent SPecification and EXecution Language

Paper • 2604.13346 • Published 24 days ago • 162

updated a dataset 17 days ago

FlippyDora/dapo-filter

Viewer • Updated 17 days ago • 9.45k • 32

published a dataset 17 days ago

FlippyDora/dapo-filter

Viewer • Updated 17 days ago • 9.45k • 32

upvoted a paper 21 days ago

Seedance 2.0: Advancing Video Generation for World Complexity

Paper • 2604.14148 • Published 23 days ago • 155

Jiarui Yao

AI & ML interests

Recent Activity

Organizations

FlippyDora's activity