SOTAVerified

Sequential Decision Making

Papers

Showing 126–150 of 1210 papers

TitleStatusHype
Vid2World: Crafting Video Diffusion Models to Interactive World Models—0
Sample and Computationally Efficient Continuous-Time Reinforcement Learning with General Function ApproximationCode0
OMGPT: A Sequence Modeling Framework for Data-driven Operational Decision Making—0
Deep Symbolic Optimization: Reinforcement Learning for Symbolic Mathematics—0
Generalization Guarantees for Learning Branch-and-Cut Policies in Integer Programming—0
Batched Nonparametric Bandits via k-Nearest Neighbor UCB—0
Sequential Treatment Effect Estimation with Unmeasured Confounders—0
Counterfactual Strategies for Markov Decision Processes—0
rfPG: Robust Finite-Memory Policy Gradients for Hidden-Model POMDPs—0
A Practical Introduction to Deep Reinforcement Learning—0
Explainable Reinforcement Learning Agents Using World Models—0
Constrained Online Decision-Making: A Unified Framework—0
A Multi-Agent Reinforcement Learning Approach for Cooperative Air-Ground-Human Crowdsensing in Emergency Rescue—0
RL-DAUNCE: Reinforcement Learning-Driven Data Assimilation with Uncertainty-Aware Constrained Ensembles—0
Active Sampling for MRI-based Sequential Decision MakingCode0
Policy-labeled Preference Learning: Is Preference Enough for RLHF?—0
MDPs with a State Sensing Cost—0
D3HRL: A Distributed Hierarchical Reinforcement Learning Approach Based on Causal Discovery and Spurious Correlation Detection—0
Bayesian learning of the optimal action-value function in a Markov decision process—0
A Minimax-MDP Framework with Future-imposed Conditions for Learning-augmented Problems—0
Self-Generated In-Context Examples Improve LLM Agents for Sequential Decision-Making Tasks—0
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments—0
SAPO-RL: Sequential Actuator Placement Optimization for Fuselage Assembly via Reinforcement Learning—0
Hierarchical Attention Fusion of Visual and Textual Representations for Cross-Domain Sequential Recommendation—0
Consensus in Motion: A Case of Dynamic Rationality of Sequential Learning in Probability Aggregation—0
Show:102550
← PrevPage 6 of 49Next →

No leaderboard results yet.