AI 基础设施

语音代理能搞定双语用户吗?代码切换ASR基准测评

测评了主流ASR模型在代码切换场景下的真实表现。发现ElevenLabs Scribe V2和Gemini 3 Flash最扛打、Whisper默认翻译会搞砸语义。最反直觉的是错误更多集中在嵌入的英语片段而非语言切换点。结论很干:服务双语客户前必须用自己的语言对做基准测试。

阅读详情语音代理能搞定双语用户吗?代码切换ASR基准测评