模型简介
豆包实时语音 SC2.0 是字节跳动 / 火山引擎的音频模型,处理声音相关输入或输出,参与音频理解、生成与交互任务。
这个型号的模型参数为 dialog.model = 2.2.0.0;服务资源标识为 volc.speech.dialog;版本定位为 角色扮演与情感陪伴。豆包是字节跳动的大模型品牌,开发者通过火山引擎接入不同任务的模型服务。
这个版本怎样理解
使用时以完整型号 2.2.0.0 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
先确认输入输出方向
识别音频、生成语音和实时对话需要不同接口。准备任务时应明确是需要文字、声音还是连续交互,再确认型号支持的格式和工作方式。
实际使用时重点看什么
音频时长、语言、采样率和流式方式都可能影响服务使用。使用自己的录音或样稿检查结果,关注延迟与信息完整性。
版本与状态
| 项目 | 信息 |
|---|---|
| 模型系列 | 豆包实时语音 |
| 版本标识 | SC2.0 |
| API 模型 / 资源 ID | 2.2.0.0 |
| 兼容标识 | 官方未另列兼容标识 |
| 目录状态 | 官方文档在列 |
支持能力与适用场景
- 端到端语音对话
- 角色与风格设定
- 语音交互
适用人群与场景:语音助手、音频创作与智能硬件开发团队。
参数与使用限制
| 参数 | 官方公开信息 |
|---|---|
| 模型参数 | dialog.model = 2.2.0.0 |
| 服务资源标识 | volc.speech.dialog |
| 版本定位 | 角色扮演与情感陪伴 |
| 版本说明 | O / SC 旧版本已升级至 O2.0 / SC2.0;音色和支持能力以各版本对照表为准 |
| 上下文 / 规格 | 按语音服务规格,详见参数说明 |
限额为官方文档列示值,具体账号可用额度和开通条件以控制台为准。参数规模、固定发布日期和权重下载地址未获官方明确披露的,不作推测。
价格与计费方式
按调用后付费:推理服务-输入-文本 10元/百万token;推理服务-输入-音频 80元/百万token;推理服务-输入-文本cached 5元/百万token;推理服务-输入-音频cached 5元/百万token;推理服务-输出-文本 80元/百万token;推理服务-输出-音频 300元/百万token。资源包、音色槽位和并发扩容另见官方计费。
| 按调用后付费计费项 | 人民币单价 |
|---|---|
| 推理服务-输入-文本 | 10元/百万token |
| 推理服务-输入-音频 | 80元/百万token |
| 推理服务-输入-文本cached | 5元/百万token |
| 推理服务-输入-音频cached | 5元/百万token |
| 推理服务-输出-文本 | 80元/百万token |
| 推理服务-输出-音频 | 300元/百万token |
计费表使用的系列名称:豆包端到端实时语音大模型。本页按官方系列价目记录,账户折扣、活动、增值服务和税费口径以官方结算为准。
官方网址与接入文档
| 项目 | 信息 |
|---|---|
| 官方模型页面 | 官方模型页面 |
| 官方接入 / 参数文档 | 官方接入 / 参数文档 |
| 官方价格说明 | 官方价格说明 |
| 豆包产品总览 | 豆包产品总览 |
同系列与其他模型
- 豆包实时语音 3.0 · Seeduplex · 官方文档在列
- 豆包实时语音 O2.0 · 官方文档在列
资料来源
本页依据火山引擎公开模型目录与官方产品文档整理。官网公布的能力和限制不等于本站实测评分,价格与服务状态可能调整。
