来源:ElevenLabs Blog(官方博客)|文章《Introducing Eleven v4, our most emotive model》|作者 ElevenLabs 团队|平台 elevenlabs.io/blog|原文链接:https://elevenlabs.io/blog
如果你关心语音 AI 走到哪一步了,ElevenLabs 的博客值得常看,因为它不是发公关稿,而是把模型迭代的硬东西摊开讲。最新的 v4 那篇里有一句话很说明问题:他们把"情绪颗粒度"当成了核心指标,而不只是"像不像人"。
为什么值得读,三个收获点:第一,语音合成正从"读字"跨到"演戏"——v4 能按上下文给同一句话不同的情绪重量,播客、有声书、游戏 NPC 的门槛又被削平一块;第二,文里顺带提到公司估值涨到 220 亿美元、由企业级对话 Agent 需求拉动,这是个信号:语音 AI 的买单者已经从 C 端玩家变成企业;第三,它讲清楚了"更快的 Turbo 版"和"更贵的完整版"分别该用在哪,省得你瞎试。
适配谁看:做音频内容、播客、出海产品的同学最该读;想接语音能力的开发者,能直接照着它的 API 文档上手。
编辑补充:文里提到的语音克隆和情绪控制,本站收录的 ElevenLabs 和 Fish Audio 都能体验,建议拿同一段中文台词在两个工具里各生成一版对比,你会对"情绪"这件事有更具体的判断。