SOTAVerified

Memorization

Papers

Showing 401–450 of 1088 papers

TitleStatusHype
CopyrightShield: Spatial Similarity Guided Backdoor Defense against Copyright Infringement in Diffusion Models—0
LoyalDiffusion: A Diffusion Model Guarding Against Data Replication—0
Learned Random Label Predictions as a Neural Network Complexity Metric—0
Integrating Functionalities To A System Via Autoencoder Hippocampus Network—0
Differential learning kinetics govern the transition from memorization to generalization during in-context learning—0
A solvable generative model with a linear, one-step denoiser—0
Classifier-Free Guidance inside the Attraction Basin May Cause MemorizationCode0
Data Watermarking for Sequential Recommender SystemsCode0
Are Large Language Models Memorizing Bug Benchmarks?—0
Branches, Assemble! Multi-Branch Cooperation Network for Large-Scale Click-Through Rate Prediction at Taobao—0
Vertical Validation: Evaluating Implicit Generative Models for Graphs on Thin Support Regions—0
Education in the Era of Neurosymbolic AI—0
Measuring Non-Adversarial Reproduction of Training Data in Large Language Models—0
Memorization in Attention-only TransformersCode0
Model Editing for LLMs4Code: How Far are We?Code0
Unlearning in- vs. out-of-distribution data in LLMs under gradient-based method—0
LSHBloom: Memory-efficient, Extreme-scale Document Deduplication—0
Extracting Unlearned Information from LLMs with Activation Steering—0
Generalizability of Memorization Neural Networks—0
Dynamic Uncertainty Ranking: Enhancing In-Context Learning for Long-Tail Knowledge in LLMs—0
A Geometric Framework for Understanding Memorization in Generative Models—0
On Memorization of Large Language Models in Logical Reasoning—0
Provably Optimal Memory Capacity for Modern Hopfield Models: Transformer-Compatible Dense Associative Memories as Spherical Codes—0
Investigating Memorization in Video Diffusion Models—0
Exploring Local Memorization in Diffusion Models via Bright Ending Attention—0
Capacity Control is an Effective Memorization Mitigation Mechanism in Text-Conditional Diffusion ModelsCode0
Historical Test-time Prompt Tuning for Vision Foundation Models—0
Measuring memorization through probabilistic discoverable extraction—0
Mixture of Parrots: Experts improve memorization more than reasoning—0
Dual-Model Defense: Safeguarding Diffusion Models from Membership Inference Attacks through Disjoint Data Splitting—0
A Simple Model of Inference Scaling Laws—0
Reasoning, Memorization, and Fine-Tuning Language Models for Non-Cooperative Games—0
Self-Comparison for Dataset-Level Membership Inference in Large (Vision-)Language Models—0
Patch-Based Diffusion Models Beat Whole-Image Models for Mismatched Distribution Inverse Problems—0
WILT: A Multi-Turn, Memorization-Robust Inductive Logic Benchmark for LLMs—0
Losing dimensions: Geometric memorization in generative diffusion—0
Emergent properties with repeated examples—0
KnowledgeSG: Privacy-Preserving Synthetic Text Generation with Knowledge Distillation from ServerCode0
In-context Learning in Presence of Spurious CorrelationsCode0
Extracting Training Data from Unconditional Diffusion Models—0
Undesirable Memorization in Large Language Models: A Survey—0
Quantifying Generalization Complexity for Large Language ModelsCode0
Composing Global Optimizers to Reasoning Tasks via Algebraic Objects in Neural Nets—0
On the Generalization and Causal Explanation in Self-Supervised LearningCode0
Mitigating Backdoor Threats to Large Language Models: Advancement and Challenges—0
Localizing Memorization in SSL Vision Encoders—0
Optimal Memorization Capacity of Transformers—0
PDFed: Privacy-Preserving and Decentralized Asynchronous Federated Learning for Diffusion Models—0
Enhancing elusive clues in knowledge learning by contrasting attention of language modelsCode0
SSP-RACL: Classification of Noisy Fundus Images with Self-Supervised Pretraining and Robust Adaptive Credal Loss—0
Show:102550
← PrevPage 9 of 22Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1PaLM-540B (few-shot, k=5)Accuracy95.4—Unverified
2Gopher-280B (few-shot, k=5)Accuracy80—Unverified
3PaLM-62B (few-shot, k=5)Accuracy77.7—Unverified