Audio-visual speech recognition
PulseAugur coverage of Audio-visual speech recognition — every cluster mentioning Audio-visual speech recognition across labs, papers, and developer communities, ranked by signal.
-
New method boosts LLM-based audio-visual speech recognition
Researchers have developed a new method called Attention-Guided Reliability Scaling (AGRS) to improve audio-visual speech recognition (AVSR) systems that use large language models. This technique adapts contrastive deco…
-
New VIB-AVSR method enhances LLM-based speech recognition in noisy conditions
Researchers have introduced VIB-AVSR, a novel approach to enhance audio-visual speech recognition models. This method integrates Variational Information Bottleneck layers into the LLM backbone to improve robustness agai…
-
New framework decodes modality contributions in audio-visual speech recognition
Researchers have developed Dr. SHAP-AV, a framework utilizing Shapley values to analyze how audio-visual speech recognition models balance acoustic and visual information. Experiments across six models and varying noise…