次浏览

豆包实时语音 3.0 · Seeduplex

AI 资源
AI音频AI模型与工具导航

更新时间:

豆包实时语音 3.0 · Seeduplex 是字节跳动 / 火山引擎的音频模型,处理声音相关输入或输出,参与音频理解、生成与交互任务。

资源信息

所属机构
字节跳动 / 火山引擎
适用对象
语音助手、音频创作与智能硬件开发团队

豆包实时语音 3.0 · Seeduplex 资源介绍

模型简介

豆包实时语音 3.0 · Seeduplex 是字节跳动 / 火山引擎的音频模型,处理声音相关输入或输出,参与音频理解、生成与交互任务。

这个型号的协议为 Realtime 事件协议,与旧版端到端接口不同;输入音频为 16000Hz;pcm / speech_opus;输出音频为 24000Hz;pcm / ogg_opus。豆包是字节跳动的大模型品牌,开发者通过火山引擎接入不同任务的模型服务。

这个版本怎样理解

使用时以完整型号 1.2.6.1 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。

先确认输入输出方向

识别音频、生成语音和实时对话需要不同接口。准备任务时应明确是需要文字、声音还是连续交互,再确认型号支持的格式和工作方式。

实际使用时重点看什么

音频时长、语言、采样率和流式方式都可能影响服务使用。使用自己的录音或样稿检查结果,关注延迟与信息完整性。

版本与状态

项目信息
模型系列豆包实时语音
版本标识3.0 / Seeduplex
API 模型 / 资源 ID1.2.6.1
兼容标识官方未另列兼容标识
目录状态官方文档在列

支持能力与适用场景

  • 全双工语音对话
  • 持续倾听与打断
  • 工具调用

适用人群与场景:语音助手、音频创作与智能硬件开发团队。

参数与使用限制

参数官方公开信息
协议Realtime 事件协议,与旧版端到端接口不同
输入音频16000Hz;pcm / speech_opus
输出音频24000Hz;pcm / ogg_opus
系统指令与上下文合计上限12K tokens(包含模型内部系统提示)
上下文 / 规格按语音服务规格,详见参数说明

限额为官方文档列示值,具体账号可用额度和开通条件以控制台为准。参数规模、固定发布日期和权重下载地址未获官方明确披露的,不作推测。

价格与计费方式

该版本的官方计费页未单列价格;请在接入前核实服务开通及结算价格。

查看官方计费说明

官方网址与接入文档

项目信息
官方模型页面官方模型页面
官方接入 / 参数文档官方接入 / 参数文档
官方价格说明官方价格说明
豆包产品总览豆包产品总览

同系列与其他模型

查看豆包完整模型与版本目录

资料来源

本页依据火山引擎公开模型目录与官方产品文档整理。官网公布的能力和限制不等于本站实测评分,价格与服务状态可能调整。

GEO导航 · AI 资源发现适合你的 AI 工具

探索工具分类,了解功能与应用场景。

GEO优化知识

更多