SOTAVerified

Video Editing

Papers

Showing 251–300 of 346 papers

TitleStatusHype
INVE: Interactive Neural Video Editing—0
Investigating the Effectiveness of Cross-Attention to Unlock Zero-Shot Editing of Text-to-Video Diffusion Models—0
InVi: Object Insertion In Videos Using Off-the-Shelf Diffusion Models—0
IP-FaceDiff: Identity-Preserving Facial Video Editing with Diffusion—0
LAMP: Learn A Motion Pattern for Few-Shot Video Generation—0
M3L: Language-based Video Editing via Multi-Modal Multi-Level Transformers—0
LAVE: LLM-Powered Agent Assistance and Language Augmentation for Video Editing—0
Learning 3D Particle-based Simulators from RGB-D Videos—0
Learning the What and How of Annotation in Video Object Segmentation—0
Let Your Video Listen to Your Music!—0
Leveraging Frame Affinity for sRGB-to-RAW Video De-rendering—0
LoRA-Edit: Controllable First-Frame-Guided Video Editing via Mask-Aware LoRA Fine-Tuning—0
MagicEdit: High-Fidelity and Temporally Coherent Video Editing—0
VEU-Bench: Towards Comprehensive Understanding of Video Editing—0
VIA: Unified Spatiotemporal Video Adaptation Framework for Global and Local Video Editing—0
VidEdit: Zero-Shot and Spatially Aware Text-Driven Video Editing—0
Video Decomposition Prior: A Methodology to Decompose Videos into Layers—0
VideoDirector: Precise Video Editing via Text-to-Video Models—0
Video Editing for Video Retrieval—0
Video Editing via Factorized Diffusion Distillation—0
Video Editing with Temporal, Spatial and Appearance Consistency—0
Video Forgery Detection for Surveillance Cameras: A Review—0
VideoGrain: Modulating Space-Time Attention for Multi-grained Video Editing—0
VideoGUI: A Benchmark for GUI Automation from Instructional Videos—0
VideoHandles: Editing 3D Object Compositions in Videos Using Video Generative Priors—0
Video Inpainting of Complex Scenes—0
VideoMap: Supporting Video Editing Exploration, Brainstorming, and Prototyping in the Latent Space—0
Videoshop: Localized Semantic Video Editing with Noise-Extrapolated Diffusion Inversion—0
VideoSPatS: Video SPatiotemporal Splines for Disentangled Occlusion, Appearance and Motion Modeling and Editing—0
VideoSwap: Customized Video Subject Swapping with Interactive Semantic Point Correspondence—0
VIDiff: Translating Videos via Multi-Modal Instructions with Diffusion Models—0
VidStyleODE: Disentangled Video Editing via StyleGAN and NeuralODEs—0
Visual Prompting for One-shot Controllable Video Editing without Inversion—0
VIVID-10M: A Dataset and Baseline for Versatile and Interactive Video Local Editing—0
V-LASIK: Consistent Glasses-Removal from Videos Using Synthetic Data—0
VLOGGER: Multimodal Diffusion for Embodied Avatar Synthesis—0
WorldDreamer: Towards General World Models for Video Generation via Predicting Masked Tokens—0
Zero-Shot Audio-Visual Editing via Cross-Modal Delta Denoising—0
Zero-Shot Video Editing through Adaptive Sliding Score Distillation—0
Zero-Shot Video Question Answering with Procedural Programs—0
Super Encoding Network: Recursive Association of Multi-Modal Encoders for Video Understanding—0
Survey of different Large Language Model Architectures: Trends, Benchmarks, and Challenges—0
Sync from the Sea: Retrieving Alignable Videos from Large-Scale Datasets—0
Task-agnostic Temporally Consistent Facial Video Editing—0
TDVE-Assessor: Benchmarking and Evaluating the Quality of Text-Driven Video Editing with LMMs—0
Temporally Consistent Semantic Video Editing—0
Text-based Talking Video Editing with Cascaded Conditional Diffusion—0
FacialFilmroll: High-resolution multi-shot video editing—0
Text-to-Edit: Controllable End-to-End Video Ad Creation via Multimodal LLMs—0
Text-Video Multi-Grained Integration for Video Moment Montage—0
Show:102550
← PrevPage 6 of 7Next →

No leaderboard results yet.