9 月 17 日,总部位于班加罗尔的具身人工智能研究实验室 Humyn Labs 发布了 BRIDGE 第二版。这是一项自动语音识别基准测试,使用经过人工验证的对话音频评估了涵盖 23 种语言的 23 个语音人工智能模型。报告发现,语音重叠使平均错误率从 41.2% 上升至 45.2%。在非印度语系语言中,ElevenLabs 的平均错误率为 5.8%,而 GPT-4o-mini-transcribe 的错误率为 24.6%。

9 月 17 日,总部位于班加罗尔的具身人工智能研究实验室 Humyn Labs 发布了 BRIDGE 第二版。这是一项自动语音识别基准测试,使用经过人工验证的对话音频评估了涵盖 23 种语言的 23 个语音人工智能模型。报告发现,语音重叠使平均错误率从 41.2% 上升至 45.2%。在非印度语系语言中,ElevenLabs 的平均错误率为 5.8%,而 GPT-4o-mini-transcribe 的错误率为 24.6%。
声明:文章不代表币圈网立场和观点,不构成本站任何投资建议。内容仅供参考!
免责声明:本站所有内容仅供用户学习和研究,不构成任何投资建议.不对任何信息而导致的任何损失负责.谨慎使用相关数据和内容,并自行承担所带来的一切风险.