SOTAVerified

Sequential Decision Making

Papers

Showing 201250 of 1210 papers

TitleStatusHype
Learning to Follow Instructions in Text-Based GamesCode0
Learning to Generalize for Sequential Decision MakingCode0
Learning to Solve the Min-Max Mixed-Shelves Picker-Routing Problem via Hierarchical and Parallel DecodingCode0
Learning Versatile Skills with Curriculum MaskingCode0
Efficient Symbolic Policy Learning with Differentiable Symbolic ExpressionCode0
Back to the Future -- Sequential Alignment of Text RepresentationsCode0
Reinforcement Learning applied to Insurance Portfolio PursuitCode0
Efficient Sequence Labeling with Actor-Critic TrainingCode0
Catastrophic-risk-aware reinforcement learning with extreme-value-theory-based policy gradientsCode0
A Parallel Hybrid Action Space Reinforcement Learning Model for Real-world Adaptive Traffic Signal ControlCode0
A Deep Reinforcement Learning Framework For Column GenerationCode0
MABWiser: A Parallelizable Contextual Multi-Armed Bandit Library for PythonCode0
Evolutionary Multi-Armed Bandits with Genetic Thompson SamplingCode0
Stay With Me: Lifetime Maximization Through Heteroscedastic Linear Bandits With RenegingCode0
Learning Coordination Policies over Heterogeneous Graphs for Human-Robot Teams via Recurrent Neural Schedule PropagationCode0
Autoregressive BanditsCode0
Dynamic Real-time Multimodal Routing with Hierarchical Hybrid PlanningCode0
Classification with Costly Features using Deep Reinforcement LearningCode0
Dynamic Simplex: Balancing Safety and Performance in Autonomous Cyber Physical SystemsCode0
Adaptive Action Duration with Contextual Bandits for Deep Reinforcement Learning in Dynamic EnvironmentsCode0
Ecole: A Library for Learning Inside MILP SolversCode0
Collaborative Comic Generation: Integrating Visual Narrative Theories with AI Models for Enhanced CreativityCode0
Autonomous Capability Assessment of Sequential Decision-Making Systems in Stochastic Settings (Extended Version)Code0
Multi-Agent Soft Actor-Critic with Coordinated Loss for Autonomous Mobility-on-Demand Fleet ControlCode0
Automaton-Guided Curriculum Generation for Reinforcement Learning AgentsCode0
Common Benchmarks Undervalue the Generalization Power of Programmatic PoliciesCode0
Adversarially Robust Decision TransformerCode0
Navigating Data Corruption in Machine Learning: Balancing Quality, Quantity, and Imputation StrategiesCode0
Flooding with Absorption: An Efficient Protocol for Heterogeneous Bandits over Complex NetworksCode0
Noise-Adaptive Confidence Sets for Linear Bandits and Application to Bayesian OptimizationCode0
Achieving Long-Term Fairness in Sequential Decision MakingCode0
Dynamical Linear BanditsCode0
Off-Policy Evaluation for Action-Dependent Non-Stationary EnvironmentsCode0
Computing the Feedback Capacity of Finite State Channels using Reinforcement LearningCode0
Discrete-Time Distribution Steering using Monte Carlo Tree SearchCode0
On Improving Deep Reinforcement Learning for POMDPsCode0
On Learning Intrinsic Rewards for Policy Gradient MethodsCode0
Online Decision Making with History-Average Dependent Costs (Extended)Code0
Differential Privacy in Cooperative Multiagent PlanningCode0
Distance Weighted Supervised Learning for Offline Interaction DataCode0
Contextual Bandits with Large Action Spaces: Made PracticalCode0
PageRank Bandits for Link PredictionCode0
Perspective-Shifted Neuro-Symbolic World Models: A Framework for Socially-Aware Robot NavigationCode0
Planning with Goal-Conditioned PoliciesCode0
Plan To Predict: Learning an Uncertainty-Foreseeing Model for Model-Based Reinforcement LearningCode0
Continuous Monte Carlo Graph SearchCode0
Did we personalize? Assessing personalization by an online reinforcement learning algorithm using resamplingCode0
A2-RL: Aesthetics Aware Reinforcement Learning for Image CroppingCode0
Differentially Private Regret Minimization in Episodic Markov Decision ProcessesCode0
DeLF: Designing Learning Environments with Foundation ModelsCode0
Show:102550
← PrevPage 5 of 25Next →

No leaderboard results yet.