SOTAVerified

General Reinforcement Learning

Papers

Showing 1–10 of 84 papers

TitleStatusHype
PeRL: Permutation-Enhanced Reinforcement Learning for Interleaved Vision-Language Reasoning—0
NOVER: Incentive Training for Language Models via Verifier-Free Reinforcement LearningCode1
High-order Regularization for Machine Learning and Learning-based Control—0
Towards More Efficient, Robust, Instance-adaptive, and Generalizable Sequential Decision making—0
Rec-R1: Bridging Generative Large Language Models and User-Centric Recommendation Systems via Reinforcement LearningCode2
The Problem of Social Cost in Multi-Agent General Reinforcement Learning: Survey and Synthesis—0
Hypercube Policy Regularization Framework for Offline Reinforcement LearningCode0
Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control TasksCode2
Reinforcement Learning: Tutorial and Survey—0
Dynamic Knowledge Injection for AIXI Agents—0
Show:102550
← PrevPage 1 of 9Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1RNBScore7—Unverified
2PPOScore5—Unverified