模型简介
豆包语音合成 1.1 是字节跳动 / 火山引擎的语音合成模型,把文字转成可播放的语音,适用于旁白、朗读和语音交互中的声音输出。
这个型号的参数用途为 在旧版 WebSocket 接口的 model 字段指定 seed-tts-1.1;音色限制为 该接口不支持语音合成 2.0 音色;接口建议为 接入新版本音色应使用官方 V3 接口。豆包是字节跳动的大模型品牌,开发者通过火山引擎接入不同任务的模型服务。
这个版本怎样理解
使用时以完整型号 seed-tts-1.1 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
从样稿到完整配音
先用包含数字、姓名、缩写和中外文混读的短稿试听,检查发音、停顿和语速。再处理完整段落,观察长句是否连贯以及不同段落的音色是否稳定。
实际使用时重点看什么
音色与模型版本是不同设置。配音制作更关注表达和一致性,实时应用还要关注首段声音的等待时间;不能只通过一句试听判断全部场景。
版本与状态
| 项目 | 信息 |
|---|---|
| 模型系列 | Doubao Seed TTS |
| 版本标识 | 1.1 |
| API 模型 / 资源 ID | seed-tts-1.1 |
| 兼容标识 | 官方未另列兼容标识 |
| 目录状态 | 历史接口版本资料 |
支持能力与适用场景
- 文本转语音
- 流式音频输出
适用人群与场景:语音助手、音频创作与智能硬件开发团队。
参数与使用限制
| 参数 | 官方公开信息 |
|---|---|
| 参数用途 | 在旧版 WebSocket 接口的 model 字段指定 seed-tts-1.1 |
| 音色限制 | 该接口不支持语音合成 2.0 音色 |
| 接口建议 | 接入新版本音色应使用官方 V3 接口 |
| 上下文 / 规格 | 按语音服务规格,详见参数说明 |
限额为官方文档列示值,具体账号可用额度和开通条件以控制台为准。参数规模、固定发布日期和权重下载地址未获官方明确披露的,不作推测。
价格与计费方式
该版本的官方计费页未单列价格;请在接入前核实服务开通及结算价格。
官方网址与接入文档
| 项目 | 信息 |
|---|---|
| 官方模型页面 | 官方模型页面 |
| 官方接入 / 参数文档 | 官方接入 / 参数文档 |
| 官方价格说明 | 官方价格说明 |
| 豆包产品总览 | 豆包产品总览 |
同系列与其他模型
- 豆包语音合成 2.0 · 官方文档在列
- 豆包语音合成 1.0 · 历史版本资料
资料来源
本页依据火山引擎公开模型目录与官方产品文档整理。官网公布的能力和限制不等于本站实测评分,价格与服务状态可能调整。
