Hugging Face 研究量化语音识别模型的基准优化行为,高分模型会复现错误基准文本
Hugging Face 发布研究,用一致性分歧探针、数字静默检索和拼写切换三类测试,评估 11 个开源 ASR 模型的基准优化(benchmaxxing)行为。
推荐理由:原文用三类探针量化语音识别中的基准优化现象,并给出模型名单、比例数据与可复用的检测脚本,读来能帮助避开仅看 WER 的选型误区。
Hugging Face 发布研究,用一致性分歧探针、数字静默检索和拼写切换三类测试,评估 11 个开源 ASR 模型的基准优化(benchmaxxing)行为。
推荐理由:原文用三类探针量化语音识别中的基准优化现象,并给出模型名单、比例数据与可复用的检测脚本,读来能帮助避开仅看 WER 的选型误区。
Hume 发布 Real World VoiceEQ 基准,评估语音 AI 交互的人性化质量,覆盖 ASR、TTS、S2S 和语音理解,评测 40 多个主流闭源与开源语音模型、15+ 维度和 60 多项指标。