SOTAVerified

Counterfactual Reasoning

Papers

Showing 1–50 of 219 papers

TitleStatusHype
HalluSegBench: Counterfactual Visual Reasoning for Segmentation Hallucination Evaluation—0
Active Inference AI Systems for Scientific Discovery—0
An introduction to Causal Modelling—0
WGSR-Bench: Wargame-based Game-theoretic Strategic Reasoning Benchmark for Large Language Models—0
Think before You Simulate: Symbolic Reasoning to Orchestrate Neural Computation for Counterfactual Question AnsweringCode0
Diffusion Counterfactual Generation with Semantic AbductionCode0
Counterfactual reasoning: an analysis of in-context emergenceCode0
Causality and "In-the-Wild" Video-Based Person Re-ID: A Survey—0
Deriving Strategic Market Insights with Large Language Models: A Benchmark for Forward Counterfactual Generation—0
Causal Cartographer: From Mapping to Reasoning Over Counterfactual WorldsCode0
Walking the Tightrope: Disentangling Beneficial and Detrimental Drifts in Non-Stationary Custom-Tuning—0
Beyond the Known: Decision Making with Counterfactual Reasoning Decision TransformerCode0
An Identifiable Cost-Aware Causal Decision-Making Framework Using Counterfactual Reasoning—0
Exogenous Isomorphism for Counterfactual IdentifiabilityCode0
Probabilistic and Causal Satisfiability: Constraining the Model—0
OmniDrive: A Holistic Vision-Language Dataset for Autonomous Driving with Counterfactual Reasoning—0
When Counterfactual Reasoning Fails: Chaos and Real-World Complexity—0
MASCOTS: Model-Agnostic Symbolic COunterfactual explanations for Time Series—0
A Causal Framework to Measure and Mitigate Non-binary Treatment DiscriminationCode0
What Changed and What Could Have Changed? State-Change Counterfactuals for Procedure-Aware Video Representation Learning—0
Causal Discovery and Counterfactual Reasoning to Optimize Persuasive Dialogue Policies—0
Neutralizing Bias in LLM Reasoning using Entailment GraphsCode0
Reasoning is All You Need for Video Generalization: A Counterfactual Benchmark with Sub-question Evaluation—0
Towards Causal Model-Based Policy Optimization—0
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts—0
Can LLMs Explain Themselves Counterfactually?—0
A novel approach to the relationships between data features -- based on comprehensive examination of mathematical, technological, and causal methodology—0
CounterBench: A Benchmark for Counterfactuals Reasoning in Large Language Models—0
Controllable Sequence Editing for Biological and Clinical TrajectoriesCode0
Counterfactual Situation Testing: From Single to Multidimensional DiscriminationCode0
Asymmetrical Latent Representation for Individual Treatment Effect Modeling—0
Leveraging counterfactual concepts for debugging and improving CNN model performance—0
Text-Driven Fashion Image Editing with Compositional Concept Learning and Counterfactual Abduction—0
Understanding Individual Agent Importance in Multi-Agent System via Counterfactual Reasoning—0
OccludeNet: A Causal Journey into Mixed-View Actor-Centric Video Action Recognition under OcclusionsCode0
Gumbel Counterfactual Generation From Language ModelsCode1
Causal Responsibility Attribution for Human-AI CollaborationCode0
Fighting Spurious Correlations in Text Classification via a Causal Learning PerspectiveCode0
Causality-Enhanced Behavior Sequence Modeling in LLMs for Personalized RecommendationCode0
CausAdv: A Causal-based Framework for Detecting Adversarial ExamplesCode0
Who is Responsible? Explaining Safety Violations in Multi-Agent Cyber-Physical Systems—0
A Novel Method to Metigate Demographic and Expert Bias in ICD Coding with Causal Inference—0
Computational Grounding of Responsibility Attribution and Anticipation in LTLf—0
Rethinking Visual Counterfactual Explanations Through Region Constraint—0
Learning to Balance Altruism and Self-interest Based on Empathy in Mixed-Motive Games—0
Mitigating Modality Prior-Induced Hallucinations in Multimodal Large Language Models via Deciphering Attention CausalityCode2
Mining Causality: AI-Assisted Search for Instrumental Variables—0
CRADLE-VAE: Enhancing Single-Cell Gene Perturbation Modeling with Counterfactual Reasoning-based Artifact DisentanglementCode0
DynamicRouteGPT: A Real-Time Multi-Vehicle Dynamic Navigation Framework Based on Large Language Models—0
Inductive or Deductive? Rethinking the Fundamental Reasoning Abilities of LLMs—0
Show:102550
← PrevPage 1 of 5Next →

No leaderboard results yet.