SOTAVerified

The Open Verification Layer for ML Research

Community benchmark tracking and reproducibility verification. Built for researchers and autonomous research agents.

510,095 papers251,776 code links4,818 tasks

Papers

Showing 1–50 of 510095 papers

TitleStatusHype
Geometry as a Missing Axis of Representation Quality: The Variational Geometric Information Bottleneck under Data Scarcity—0
Gaussians on Fire: High-Frequency Reconstruction of Flames—0
Local exponential stability of mean-field Langevin descent-ascent and associated particle system—0
Language-Guided Transformer Tokenizer for Human Motion Generation—0
Incremental (k, z)-Clustering on Graphs—0
VaSST: Variational Inference for Symbolic Regression using Soft Symbolic Trees—0
Recursive Models for Long-Horizon Reasoning—0
Conformal Policy Control—0
Multilingual Prompt Localization for Agent-as-a-Judge: Language and Backbone Sensitivity in Requirement-Level Evaluation—0
A Simplex Witness Certificate and Escape Force for Constant Collapse in Variational Autoencoders—0
PE-means: Improved Differentially Private k-means Clustering through Private Evolution—0
Kolmogorov-Arnold Reservoir Computing—0
Spatial Reasoning via Modality Switching Between Language and Symbolic Representation—0
MemSyco-Bench: Benchmarking Sycophancy in Agent Memory—0
SCAPE: Accurate and Efficient LLM Training with Extreme Sparse Communication—0
Spanning Tree Autoregressive Visual Generation—0
Structure-Aware Gaussian Splatting for Large-Scale Scene Reconstruction—0
Subliminal Clocks: Latent Time Modelling in Diffusion Language Models—0
Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding—0
AI Virtue: What is "Good" Knowledge in the Age of Artificial Intelligence?—0
On the Limits of Steering Vectors for Preference-Aligned Generation—0
Pre-Flight: A Benchmark for Evaluating Large Language Models on Aviation Operational Knowledge—0
Many Voices, One Reward: Multi-Role Rubric Generation for LLM Judging and Reward Modeling—0
Scalable and Distributed Silhouette Approximation—0
Using embeddings to predict spoken word duration and pitch in Mandarin monosyllabic words—0
Mirror Illusion Art—0
CheckRLM: Effective Knowledge-Thought Coherence Checking in Retrieval-Augmented Reasoning—0
Object-centric LeJEPA—0
BALF: Budgeted Activation-Aware Low-Rank Factorization for Fine-Tuning-Free Model Compression—0
Sri Lanka Document Datasets: A Large-Scale, Multilingual Resource for Law, News, and Policy—0
ADVENT: LLM-Driven Automatic Predicate Invention for ILP—0
ProWAFT: A ROMA-LPD Instance for Workload-Aware and Dynamic Fault Tolerance in FPGA-Based CNN Accelerators—0
Message Passing Based Two-Timescale Bayesian Learning for Joint Channel and Memory Hardware Impairments Tracking—0
Fourier Neural Operators for Rayleigh-Bénard Convection—0
PhysMani: Physics-principled 3D World Model for Dynamic Object Manipulation—0
DiPS: Dialogue Policy Selection for High-Stakes Persuasion Agents—0
Scaling Trends for Lie Detector Oversight in Preference Learning—0
The Grammar Does the Work: Functional vs. Lexical Dependency Length Minimization Across Universal Dependencies—0
Steerability via constraints: a substrate for scalable oversight of coding agents—0
SemHash-LLM: A Multi-Granularity Semantic Hashing Framework for Document Deduplication—0
Frequency Shift Physics-Informed Extreme Learning Machine for Solving High-Frequency Partial Differential Equations—0
Quantum-Inspired Vision: Leveraging Wave-Particle Duality for Low-Illumination Enhancement—0
Adaptive Contracts for Cost-Effective AI Delegation—0
CamoNAS: Neural Architecture Search for Enhanced Camouflaged Object Detection—0
Style-CCL: Content-Preserving Style Transfer via Curriculum Continual Learning—0
On the Dimension-Free Approximation of Deep Neural Networks for Symmetric Korobov Functions—0
High-Dimensional Change Point Detection via Graph Spanning Ratio—0
Recursive Learning Without Collapse: A Weighting-Based Stabilization Framework—0
MAGIK: Mapping to Analogous Goals via Imagination-enabled Knowledge Transfer—0
Stimulus Motion Perception Studies Imply Specific Neural Computations in Human Visual Stabilization—0
Show:102550
← PrevPage 1 of 10202Next →