SynthVSR: Scaling Up Visual Speech Recognition With Synthetic Supervision Mar 30, 2023 Lip Reading speech-recognition
— Unverified 0Towards Estimating the Upper Bound of Visual-Speech Recognition: The Visual Lip-Reading Feasibility Database Apr 26, 2017 Automatic Speech Recognition Automatic Speech Recognition (ASR)
— Unverified 0Towards MOOCs for Lipreading: Using Synthetic Talking Heads to Train Humans in Lipreading at Scale Aug 21, 2022 Lipreading Lip Reading
— Unverified 0Towards Pose-invariant Lip-Reading Nov 14, 2019 Lip Reading
— Unverified 0VALLR: Visual ASR Language Model for Lip Reading Mar 27, 2025 Automatic Speech Recognition Language Modeling
— Unverified 0VCSE: Time-Domain Visual-Contextual Speaker Extraction Network Oct 9, 2022 Lip Reading
— Unverified 0Video-Based Action Recognition Using Rate-Invariant Analysis of Covariance Trajectories Mar 23, 2015 Action Recognition General Classification
— Unverified 0Visual Passwords Using Automatic Lip Reading Sep 2, 2014 Lip Reading
— Unverified 0VisualSpeaker: Visually-Guided 3D Avatar Lip Synthesis Jul 8, 2025 Automatic Speech Recognition Lip Reading
— Unverified 0Visual Speech Recognition Sep 3, 2014 Audio-Visual Speech Recognition Lip Reading
— Unverified 0Visual Speech Recognition in a Driver Assistance System Aug 29, 2022 Data Augmentation Lipreading
— Unverified 0Visual Words for Automatic Lip-Reading Sep 17, 2014 Lip Reading speech-recognition
— Unverified 0Which phoneme-to-viseme maps best improve visual-only computer lip-reading? Oct 3, 2017 Lip Reading speech-recognition
— Unverified 0Word-level Persian Lipreading Dataset Apr 8, 2023 Lipreading Lip Reading
— Unverified 0Neuromorphic Facial Analysis with Cross-Modal Supervision Sep 16, 2024 Lip Reading
— Unverified 0Perception Point: Identifying Critical Learning Periods in Speech for Bilingual Networks Oct 13, 2021 Lip Reading speech-recognition
— Unverified 0PixelRNN: In-pixel Recurrent Neural Networks for End-to-end-optimized Perception with Neural Sensors Apr 11, 2023 Gesture Recognition Hand Gesture Recognition
— Unverified 0Pseudo-Convolutional Policy Gradient for Sequence-to-Sequence Lip-Reading Mar 9, 2020 Lipreading Lip Reading
— Unverified 0Quantitative Analysis of Audio-Visual Tasks: An Information-Theoretic Perspective Sep 29, 2024 Audio-Visual Speech Recognition Lip Reading
— Unverified 0RAL:Redundancy-Aware Lipreading Model Based on Differential Learning with Symmetric Views Sep 9, 2024 Lipreading Lip Reading
— Unverified 0Realistic Speech-Driven Facial Animation with GANs Jun 14, 2019 Audio-Visual Synchronization Lip Reading
— Unverified 0Relaxed Attention for Transformer Models Sep 20, 2022 Decoder Image Classification
— Unverified 0Resolution limits on visual speech recognition Oct 3, 2017 Lip Reading speech-recognition
— Unverified 0Resource aware design of a deep convolutional-recurrent neural network for speech recognition through audio-visual sensor fusion Mar 13, 2018 Automatic Speech Recognition Automatic Speech Recognition (ASR)
— Unverified 0Re-synchronization using the Hand Preceding Model for Multi-modal Fusion in Automatic Continuous Cued Speech Recognition Feb 23, 2020 Lip Reading Phoneme Recognition
— Unverified 0Robust Multi-Modal Speech In-Painting: A Sequence-to-Sequence Approach Jun 2, 2024 Lip Reading Multi-Task Learning
— Unverified 0A Cascade Sequence-to-Sequence Model for Chinese Mandarin Lip Reading Aug 14, 2019 Lipreading Lip Reading
— Unverified 0Seeing voices and hearing voices: learning discriminative embeddings using cross-modal self-supervision Apr 29, 2020 Lip Reading Self-Supervised Learning
— Unverified 0SimulLR: Simultaneous Lip Reading Transducer with Attention-Guided Adaptive Memory Aug 31, 2021 Lip Reading
— Unverified 0Some observations on computer lip-reading: moving from the dream to the reality Oct 3, 2017 Lip Reading
— Unverified 0Spatio-Temporal Attention Mechanism and Knowledge Distillation for Lip Reading Aug 7, 2021 Audio-Visual Speech Recognition Knowledge Distillation
— Unverified 0Spatio-Temporal Fusion Based Convolutional Sequence Learning for Lip Reading Oct 1, 2019 Lipreading Lip Reading
— Unverified 0Spatio-temporal Transformers for Action Unit Classification with Event Cameras Oct 29, 2024 Lip Reading
— Unverified 0Speaker-independent machine lip-reading with speaker-dependent viseme classifiers Oct 3, 2017 Clustering Lip Reading
— Unverified 0Speech Driven Video Editing via an Audio-Conditioned Diffusion Model Jan 10, 2023 Denoising Face Model
— Unverified 0Multi-Perspective LSTM for Joint Visual Representation Learning May 6, 2021 Face Recognition Lip Reading
Code Code Available 0MTGA: Multi-View Temporal Granularity Aligned Aggregation for Event-Based Lip-Reading Apr 18, 2024 Lip Reading
Code Code Available 0LRW-1000: A Naturally-Distributed Large-Scale Benchmark for Lip Reading in the Wild Oct 16, 2018 Lipreading Lip Reading
Code Code Available 0Transforming faces into video stories -- VideoFace2.0 May 4, 2025 Face Detection Face Recognition
Code Code Available 0Lip Sync Matters: A Novel Multimodal Forgery Detector Nov 7, 2022 DeepFake Detection Face Swapping
Code Code Available 0Lip2AudSpec: Speech reconstruction from silent lip movements video Oct 26, 2017 Lip Reading
Code Code Available 0Talking Face Generation by Adversarially Disentangled Audio-Visual Representation Jul 20, 2018 Face Generation Lip Reading
Code Code Available 0Lend a Hand: Semi Training-Free Cued Speech Recognition via MLLM-Driven Hand Modeling for Barrier-free Communication Mar 11, 2025 Lip Reading Prompt Engineering
Code Code Available 0Learning Separable Hidden Unit Contributions for Speaker-Adaptive Lip-Reading Oct 8, 2023 Lip Reading
Code Code Available 0Estimating speech from lip dynamics Aug 3, 2017 Lip Reading Position
Code Code Available 0DualTalker: A Cross-Modal Dual Learning Approach for Speech-Driven 3D Facial Animation Nov 8, 2023 Lip Reading
Code Code Available 0Combining Residual Networks with LSTMs for Lipreading Mar 12, 2017 Lipreading Lip Reading
Code Code Available 0Audio-Visual Speech Recognition based on Regulated Transformer and Spatio-Temporal Fusion Strategy for Driver Assistive Systems May 9, 2024 Audio-Visual Speech Recognition Lipreading
Code Code Available 0XFlow: Cross-modal Deep Neural Networks for Audiovisual Classification Sep 2, 2017 Classification General Classification
Code Code Available 0A Novel Interpretable and Generalizable Re-synchronization Model for Cued Speech based on a Multi-Cuer Corpus Jun 5, 2023 Lip Reading
Code Code Available 0