9 月 17 日,总部位于班加罗尔的具身人工智能研究实验室 Humyn Labs 发布了 BRIDGE 第二版。这是一项自动语音识别基准测试,使用经过人工验证的对话音频评估了涵盖 23 种语言的 23 个语音人工智能模型。报告发现,语音重叠使平均错误率从 41.2% 上升至 45.2%。在非印度语系语言中,ElevenLabs 的平均错误率为 5.8%,而 GPT-4o-mini-transcribe 的错误率为 24.6%。