Artificial Analysis · X更新于

发音鲁棒性衡量了文本转语音模型在四个类别中能否正确发音具有挑战性的文本,以及人类的……

发音稳健性指标用于衡量文本转语音模型在四个类别中能否正确发音。人类评审员会根据预先约定的标准发音对每个片段进行评判。 ➤ 扩展速记:Eleven v4 Turbo 得分为 91.9%,排名第 2,低于得分 94.1% 的 Eleven v4,高于得分 86.1% 的 Gemini 3.8 Flash TTS。 ➤ 语境适应性:Eleven v4 Turbo 得分为 95.8%,高于得分 94.1% 的 Eleven v4,而…

配图来源 · Artificial Analysis · X

发音稳健性衡量了文本转语音模型在四个类别中能否正确发音具有挑战性的文本,人类评审员会根据预先约定的标准发音对每个片段进行评判。

➤ 扩展简写:Eleven v4 Turbo 以 91.9%的得分位居第2,低于 Eleven v4 的 94.1%,但高于 Gemini 3.8 Flash TTS 的 86.1%。

➤ 符合上下文:Eleven v4 Turbo 的得分率为 95.8%,高于 Eleven v4 的 94.1%,而 Gemini 的 3.8 Flash TTS 得分率为 97.9%。

➤ 独立术语:Eleven v4 Turbo 得分为 91.4%,而 Eleven v3 Conversational 得分为 95.1%,表现更优。

➤ 保留精确序列:Eleven v4 Turbo 的得分率为 73.9%,高于 Eleven v3 的 71.2%,而 SpaceXAI TTS 的得分率为 85.7%。

原始出处

Artificial Analysis · X

内容说明

原始发布及相关权利归来源方。

机器翻译 · 请以原文为准