Eleven v4 在线试用 - ElevenLabs v4 免费体验
免费在线试用 Eleven v4,无需注册:输入 200 字以内,马上听 ElevenLabs 最新模型的效果。支持情绪标签和 90 多种语言,附真实样音与价格。
最近更新: 2026-10-05
Eleven v4 是 ElevenLabs 在 2026 年 9 月 28 日发布的最新文字转语音模型。 它会像配音演员一样读懂上下文再开口,能按 [whispers](耳语)、[laughs](笑)这类标签演出情绪,支持 90 多种语言,单次最多 10,000 个字符。下面直接输入文字就能听,不用注册。
免费试用 Eleven v4,无需注册
每天免费 2 次,每次最多 200 字。方括号里的标签会被演出来,不会被念出来。
Eleven v4 基本参数
| Eleven v4 | |
|---|---|
| 出品方 | ElevenLabs |
| 发布时间 | 2026 年 9 月 28 日 |
| 模型 ID | eleven_v4(低延迟版 eleven_v4_turbo) |
| 语言 | 90+(API 列出 85 个语言代码,比 v3 多 11 个,新增粤语等) |
| 单次长度上限 | 10,000 字符,约 10 分钟音频 |
| 情绪标签 | 支持,可叠加:[whispers] [laughs] [sighs] [excited] … |
| ElevenLabs 官方价格 | 和其他 TTS 模型同价 |
| 在声匠怎么用 | 配音工作台选 Eleven v4;有声剧工坊每部剧都用 v4 渲染 |
试听:Eleven v4 真实生成效果
以下音频都是 2026 年 10 月 5 日用 eleven_v4、默认参数一次生成的,没有挑选,也没有后期剪辑。播放器下面的文字就是发给模型的原稿,标签也原样保留。
普通话旁白:
普通话加情绪标签:笑、压低声音、叹气都是演出来的,标签本身一个字都没念:
[laughs] 你以为我会就这么算了?[whispers] 合同在我手里,三天之内,你会求着来找我。[sighs] 可惜啊,我们本来可以是朋友。一次请求里两个角色对话(v4 的 text-to-dialogue):
[curious] 你这猴头,又从哪里闯了祸回来?
[laughs] 师父莫急,俺老孙不过是借了他三根毫毛!
[sighs] 借?只怕人家此刻正满山找你呢。
[excited] 找便找,俺一个筋斗,早到了十万八千里外!英文旁白,以及带标签的英文台词:
[whispers] Okay, don't move. I think it's still in the kitchen. [nervous] What if it heard us? [laughs] Relax, it's just the cat. [sighs] You scared me half to death.日语和巴西葡萄牙语,ElevenLabs 说这两种语言在 v4 上提升最大:
Eleven v4 新在哪
- 按意思去读。 ElevenLabs 的说法是 v4 知道「谁在说话、刚刚发生了什么」,所以语气跟着剧情走,不是一句一句孤立地念。
- 情绪标签更强。 标签可以叠加、连用,v4 会按你写的顺序执行。
- 90 多种语言。 我们从 ElevenLabs API 拉到的模型列表里,v4 有 85 个语言代码,v3 是 74 个。新增的是粤语、缅甸语、蒙古语、乌兹别克语、约鲁巴语、马耳他语、毛利语、奥里亚语、塔吉克语、阿斯图里亚斯语和奥克语。官方点名提升最大的是日语、巴西葡萄牙语、普通话和粤语。
- 单次长度翻倍。 从 v3 的 5,000 字符提到 10,000,并用「上下文衔接」让长文的节奏保持一致。
- 重生成还是同一个人。 改一句重新生成,声音仍然是同一个角色。长篇里只修一句话时,这一点很关键。
- Turbo 版做实时。
eleven_v4_turbo面向语音 Agent,官方给出中位推理延迟约 100 毫秒,首句出声约 150 毫秒。
v4 能用的情绪标签
把英文标签写在方括号里,放在要变化的那句话前面。下面这些在我们的测试里都生效了:
| 标签 | 效果 |
|---|---|
[whispers] | 接下来的话变成耳语 |
[laughs] | 真的笑出来,不会念出「laughs」这个词 |
[sighs] | 先叹一口气 |
[excited] | 语速更快、更兴奋 |
[nervous] | 犹豫、发虚 |
[curious] | 好奇、上扬的语调 |
[sarcastic] | 平淡的反讽 |
[shouts] | 提高音量喊出来 |
标签只影响演绎,不会被读出来,也不会出现在字幕里。更完整的标签清单和例子见情绪标签速查表。
Eleven v4 和 v3 差多少
我们用 7 段脚本、同一组音色,每个模型各生成 3 次做了对比:v4 生成速度是 v3 的 1.6 倍,准确率持平;42 次生成里,两个模型都没有把标签念出来。另外 v4 单次长度翻倍,还多了 11 种语言。完整数据和每一组对照音频见 Eleven v4 vs v3 对比实测。同样的脚本我们也用 Google 的新模型跑了一遍,见 Gemini 3.8 TTS 和 Eleven v4 对比。
在声匠怎么用 Eleven v4
- 单人配音。 打开已经选好 Eleven v4 的配音工作台,选音色,点一下就能插入情绪标签,然后生成。按钮上会先显示要花多少积分。
- 多人有声剧。 把小说或剧本贴进有声剧工坊,系统会找出角色、给每个角色配音色、逐句加情绪,再用 Eleven v4 渲染整章,并附字幕。
- 先听长篇成品。 有声剧场里的 76 集全部由 Eleven v4 生成,总长 10.8 小时,覆盖中文、英文和另外五种语言。比如这一集:
通过 API 调用 Eleven v4
如果你直接调用 ElevenLabs,只需要把 model_id 换成 eleven_v4,标签直接写进文本:
curl -X POST "https://api.elevenlabs.io/v1/text-to-speech/<voice_id>?output_format=mp3_44100_128" \
-H "xi-api-key: $ELEVENLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{"text": "[whispers] 成了。[laughs] 真的成了。", "model_id": "eleven_v4"}' \
--output v4.mp3
渲染剧场时我们踩过一个坑:用 text-to-dialogue 生成较长的中文对白时,单次请求到 1,700 字左右,v4 偶尔会不报错地漏掉最后几句。我们的解决办法是:中日韩文本每次请求控制在 1,200 字以内,并检查每一句都有时间戳。
常见问题
Eleven v4 是什么? ElevenLabs 最新的文字转语音模型。它会像配音演员一样理解上下文去演绎台词,支持 [whispers]、[laughs] 这类行内情绪标签,覆盖 90 多种语言,单次最多 10,000 个字符。
Eleven v4 什么时候发布的? 2026 年 9 月 28 日,和面向实时语音 Agent 的低延迟版 Eleven v4 Turbo 一起发布。
Eleven v4 免费吗? 在本页不用注册,每天可以用 Eleven v4 免费生成 2 次,每次最多 200 字。ElevenLabs 官方对 v4 的计费和其他 TTS 模型相同,官方免费版每月有 10,000 credits。在声匠,v4 和 v3 同价,见价格。
Eleven v4 中文效果怎么样? 支持普通话,粤语是 v4 新增的语言。我们的实测里,v4 读一段普通话旁白连续 3 次都没有转写错误;同一段 v3 有 2 次「眼镜」被转写成了「眼睛」。
Eleven v4 的模型 ID 是什么? Eleven v4 是 eleven_v4,Turbo 版是 eleven_v4_turbo,在 text-to-speech 或 text-to-dialogue 请求里作为 model_id 传入。
Eleven v4 一次能生成多长? 单次请求最多 10,000 个字符,约 10 分钟音频;v3 是 5,000。
Eleven v4 和 v4 Turbo 选哪个? 配音、有声书、角色对白等要发布的内容用 Eleven v4;实时语音 Agent 这类更看重延迟的场景用 v4 Turbo,ElevenLabs 给出的中位推理延迟约 100 毫秒。
声匠和 ElevenLabs 是什么关系? 声匠是独立产品,通过 ElevenLabs 官方 API 提供服务,与 ElevenLabs 没有隶属关系。Eleven v4 和 ElevenLabs 是 ElevenLabs 的商标。