Real World VoiceEQ 评测基准发布,评估语音 AI 的真实人类交互能力
Real World VoiceEQ 语音评测基准发布,基于超过 100 万次人类独立评分评估 40 多款主流专有和开源语音模型的真实交互水平。该基准涵盖 ASR、TTS、S2S 与语音理解等领域共 15 个维度和 60 多项指标,依托 Kairos 评测平台构建。评测发现语音模型正走向能力专业化,且多数模型在语气、情绪和停顿等副语言感知上仍落后于表达能力。
Real World VoiceEQ 语音评测基准发布,基于超过 100 万次人类独立评分评估 40 多款主流专有和开源语音模型的真实交互水平。该基准涵盖 ASR、TTS、S2S 与语音理解等领域共 15 个维度和 60 多项指标,依托 Kairos 评测平台构建。评测发现语音模型正走向能力专业化,且多数模型在语气、情绪和停顿等副语言感知上仍落后于表达能力。
Treble Technologies 与 Hugging Face 联合推出首个开源远场语音识别评测榜单 FFASR Leaderboard,用于系统评估 ASR 模型在真实远场声学环境下的表现。