PulseAugur
实时 20:40:57
实体 Speaker identification

Speaker identification

PulseAugur coverage of Speaker identification — every cluster mentioning Speaker identification across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
关系
情绪 · 30 天

2 天有情绪数据

最近 · 第 1/1 页 · 共 3 条
  1. TOOL · CL_167678 ·

    OpenCV 机器学习论文将人脸识别与声学数据融合以进行说话人身份识别

    本文详细介绍了一种在 OpenCV 库中使用机器学习进行人脸识别的方法。它提出将面部识别结果与声学相机定位数据融合以识别说话人。这种组合方法旨在提供实时的情境描述,可能支持通过自适应波束成形实现多通道语音增强等应用。

  2. COMMENTARY · CL_155785 ·

    AssemblyAI 阐明音频分析中的说话人日志与识别的区别

    AssemblyAI 阐明了音频分析中说话人日志与说话人识别的区别。说话人日志用于识别音频文件中存在多少个不同的说话人,并相应地分割音频,分配匿名的标签,如“说话人 A”或“说话人 B”。而说话人识别则旨在识别与特定声音相关联的个体,用于安全和个性化语音助手等功能。

  3. RESEARCH · CL_82099 ·

    语音模型编码说话人的人口统计信息,影响公平性

    一篇新的研究论文探讨了自监督语音识别模型如何编码说话人分组信息。研究发现,这些模型可以识别性别、年龄、方言、种族和母语者身份等特征。对模型进行说话人识别或自动语音识别(ASR)的微调会改变保留的说话人分组信息的类型,其中ASR微调会丢弃语音变异而保留语义变异。研究表明,这些发现可能有助于开发更公平的ASR算法。