SOTAVerified

Sequential Decision Making

Papers

Showing 1101–1150 of 1210 papers

TitleStatusHype
Machine Teaching for Inverse Reinforcement Learning: Algorithms and ApplicationsCode0
Fast Online Exact Solutions for Deterministic MDPs with Sparse Rewards—0
On Improving Deep Reinforcement Learning for POMDPs—0
On Learning Intrinsic Rewards for Policy Gradient MethodsCode0
UCBoost: A Boosting Approach to Tame Complexity and Optimality for Stochastic Bandits—0
Policy Gradient With Value Function Approximation For Collective Multiagent Planning—0
Hindsight is Only 50/50: Unsuitability of MDP based Approximate POMDP Solvers for Multi-resolution Information Gathering—0
Accelerating E-Commerce Search Engine Ranking by Contextual Factor Selection—0
Hierarchical Imitation and Reinforcement Learning—0
Deep Bayesian Bandits Showdown: An Empirical Comparison of Bayesian Deep Networks for Thompson SamplingCode0
Novel Approaches to Accelerating the Convergence Rate of Markov Decision Process for Search Result Diversification—0
Structured Control Nets for Deep Reinforcement LearningCode0
An Anytime Algorithm for Task and Motion MDPs—0
MPC-Inspired Neural Network Policies for Sequential Decision Making—0
Decomposition Methods with Deep Corrections for Reinforcement LearningCode0
Understanding Human Behaviors in Crowds by Imitating the Decision-Making Process—0
Testing Optimality of Sequential Decision-Making—0
Learning Structural Weight Uncertainty for Sequential Decision-MakingCode0
Deep Reinforcement Learning for Unsupervised Video Summarization with Diversity-Representativeness RewardCode0
Multi-shot Pedestrian Re-identification via Sequential Decision Making—0
Q-LDA: Uncovering Latent Patterns in Text-based Sequential Decision Processes—0
Classification with Costly Features using Deep Reinforcement LearningCode0
Loss Functions for Multiset Prediction—0
Servant of Many Masters: Shifting priorities in Pareto-optimal sequential decision-making—0
How Should a Robot Assess Risk? Towards an Axiomatic Theory of Risk in Robotics—0
Hierarchical State Abstractions for Decision-Making Problems with Computational Constraints—0
Asymmetric Actor Critic for Image-Based Robot Learning—0
Detecting Adversarial Attacks on Neural Network Policies with Visual ForesightCode0
A2-RL: Aesthetics Aware Reinforcement Learning for Image CroppingCode0
Optimal Learning for Sequential Decision Making for Expensive Cost Functions with Stochastic Binary Feedbacks—0
Safety-Aware Algorithms for Adversarial Contextual Bandit—0
Non-Stationary Bandits with Habituation and Recovery Dynamics—0
Learning for Multi-robot Cooperation in Partially Observable Stochastic Environments with Macro-actions—0
Learning model-based planning from scratchCode0
Correlational Dueling Bandits with Application to Clinical Treatment in Large Decision Spaces—0
Tableaux for Policy Synthesis for MDPs with PCTL* Constraints—0
The Theory is Predictive, but is it Complete? An Application to Human Perception of Randomness—0
Unlocking the Potential of Simulators: Design with RL in Mind—0
A method for the online construction of the set of states of a Markov Decision Process using Answer Set Programming—0
Boltzmann Exploration Done Right—0
Learning to Mix n-Step Returns: Generalizing lambda-Returns for Deep Reinforcement Learning—0
Answer Set Programming for Non-Stationary Markov Decision Processes—0
On Improving Deep Reinforcement Learning for POMDPsCode0
Using Reinforcement Learning for Demand Response of Domestic Hot Water Buffers: a Real-Life Demonstration—0
Minimizing Maximum Regret in Commitment Constrained Sequential Decision Making—0
Deep Robust Kalman Filter—0
Deeply AggreVaTeD: Differentiable Imitation Learning for Sequential Prediction—0
Active Learning for Accurate Estimation of Linear Models—0
Tight Bounds for Bandit Combinatorial Optimization—0
Learning to Repeat: Fine Grained Action Repetition for Deep Reinforcement Learning—0
Show:102550
← PrevPage 23 of 25Next →

No leaderboard results yet.