PulseAugur
实时 12:02:38
English(EN) AudioTQ: A Data-Oblivious 6-Bit CPU Audio Codec via Randomized Hadamard Rotation and Lloyd-Max Quantization

受LLM量化技术启发的6位音频编解码器

研究人员开发了AudioTQ,一种新颖的6位音频编解码器,它直接在时域操作,绕过了传统的心理声学建模。受大型语言模型权重量化中使用技术的启发,AudioTQ采用随机快速Walsh-Hadamard变换进行幅度均一化,然后是Lloyd-Max量化器和残差校正层。这种方法允许在标准CPU上进行实时单线程执行,并实现了约30 dB的信噪比,基准测试表明文件大小最多可减少74.4%。 AI

影响 这种受LLM量化启发的创新音频编解码器可能为各种应用带来更高效的音频压缩技术。

排序理由 该项目是一篇详细介绍新型音频编解码器的研究论文。[lever_c_demoted from research: ic=1 ai=0.7]

在 arXiv cs.AI 阅读 →

AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →

受LLM量化技术启发的6位音频编解码器

报道来源 [1]

  1. arXiv cs.AI TIER_1 English(EN) · Sahil Gangurde ·

    AudioTQ:一种通过随机Hadamard旋转和Lloyd-Max量化实现的、数据无关的6位CPU音频编解码器

    arXiv:2608.15369v1 Announce Type: cross Abstract: Lossy audio compression algorithms traditionally rely on psychoacoustic modeling and frequency-domain representations (e.g., MP3, AAC, and Opus) to discard information that is imperceptible to the human auditory system. While high…