SOTAVerified

Image Manipulation

Image Manipulation is the process of altering or transforming an existing image to achieve a desired effect or to modify its content. This can involve various techniques and tools to enhance, modify, or create images based on specific requirements.

Papers

Showing 1–50 of 427 papers

TitleStatusHype
Beyond Fully Supervised Pixel Annotations: Scribble-Driven Weakly-Supervised Framework for Image Manipulation Localization—0
Towards Reliable Identification of Diffusion-based Image Manipulations—0
UniWorld-V1: High-Resolution Semantic Encoders for Unified Visual Understanding and GenerationCode4
Weakly-supervised Localization of Manipulated Image Regions Using Multi-resolution Learned Features—0
RBench-V: A Primary Assessment for Visual Reasoning Models with Multi-modal Outputs—0
My Face Is Mine, Not Yours: Facial Protection Against Diffusion Model Face Swapping—0
Visual Agentic Reinforcement Fine-TuningCode7
Emerging Properties in Unified Multimodal PretrainingCode9
Anti-Inpainting: A Proactive Defense against Malicious Diffusion-based Inpainters under Unknown Conditions—0
ForensicHub: A Unified Benchmark & Codebase for All-Domain Fake Image Detection and LocalizationCode2
3D-Fixup: Advancing Photo Editing with 3D Priors—0
IntrinsicEdit: Precise generative image manipulation in intrinsic space—0
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models—0
Visual Text Processing: A Comprehensive Review and Unified EvaluationCode2
Step1X-Edit: A Practical Framework for General Image EditingCode7
Can GPT tell us why these images are synthesized? Empowering Multimodal Large Language Models for Forensics—0
AnimeDL-2M: Million-Scale AI-Generated Anime Image Detection and Localization in Diffusion Era—0
Towards Explainable Partial-AIGC Image Quality Assessment—0
Pro-DG: Procedural Diffusion Guidance for Architectural Facade Generation—0
Patronus: Bringing Transparency to Diffusion Models with PrototypesCode0
Context-Aware Weakly Supervised Image Manipulation Localization with SAM Refinement—0
LEGION: Learning to Ground and Explain for Synthetic Image Detection—0
Advancing 3D Gaussian Splatting Editing with Complementary and Consensus Information—0
Deepfake Detection of Face Images based on a Convolutional Neural Network—0
EmoAgent: A Multi-Agent Framework for Diverse Affective Image Manipulation—0
PlanGen: Towards Unified Layout Planning and Image Generation in Auto-Regressive Vision Language Models—0
IMDPrompter: Adapting SAM to Image Manipulation Detection by Cross-View Automated Prompt Learning—0
LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention MapsCode0
Joint Learning of Depth and Appearance for Portrait Image Animation—0
Data-Driven Fairness Generalization for Deepfake Detection—0
Can We Get Rid of Handcrafted Feature Extractors? SparseViT: Nonsemantics-Centered, Parameter-Efficient Image Manipulation Localization through Spare-Coding TransformerCode2
Mesoscopic Insights: Orchestrating Multi-scale & Hybrid Architecture for Image Manipulation LocalizationCode2
Prompt Augmentation for Self-supervised Text-guided Image Manipulation—0
Instruction-based Image Manipulation by Watching How Things Move—0
Detecting Facial Image Manipulations with Multi-Layer CNN Models—0
EditScout: Locating Forged Regions from Diffusion-based Edited Images with Multimodal LLM—0
Unleashing In-context Learning of Autoregressive Models for Few-shot Image Manipulation—0
ForgerySleuth: Empowering Multimodal Large Language Models for Image Manipulation DetectionCode1
Omni-IML: Towards Unified Image Manipulation Localization—0
HyperGAN-CLIP: A Unified Framework for Domain Adaptation, Image Synthesis and ManipulationCode2
Visual question answering based evaluation metrics for text-to-image generation—0
HRGR: Enhancing Image Manipulation Detection via Hierarchical Region-aware Graph Reasoning—0
Kandinsky 3: Text-to-Image Synthesis for Multifunctional Generative FrameworkCode3
Training Free Guided Flow Matching with Optimal Control—0
SLIC: Secure Learned Image Codec through Compressed Domain Watermarking to Defend Image Manipulation—0
PUMA: Empowering Unified MLLM with Multi-granular Visual GenerationCode2
TextCtrl: Diffusion-based Scene Text Editing with Prior Guidance ControlCode2
DiffusionGuard: A Robust Defense Against Malicious Diffusion-based Image EditingCode1
AIM 2024 Challenge on Video Super-Resolution Quality Assessment: Methods and Results—0
Exploring Strengths and Weaknesses of Super-Resolution Attack in Deepfake Detection—0
Show:102550
← PrevPage 1 of 9Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Pix2PixHD-SIALPIPS (S1)0.44—Unverified
2TPSLPIPS (S1)0.12—Unverified