模型简介
GPT-4o Realtime 是OpenAI的音频模型,处理声音相关输入或输出,参与音频理解、生成与交互任务。
OpenAI 的模型产品包括 GPT 通用模型、Codex 编程模型,以及图像、语音、视频和向量等专用模型。
这个版本怎样理解
官方已把该版本标为弃用或历史型号。弃用与立即下线不是同一状态,现有业务应查看生命周期公告;新项目不宜把它当作默认接入选择。
版本与模型标识
| 模型名称 | GPT-4o Realtime |
|---|---|
| 标识类型 | 官方模型标识 |
| 完整型号 / 标识 | gpt-4o-realtime-preview |
| 版本状态 | 已弃用:历史版本 |
先确认输入输出方向
识别音频、生成语音和实时对话需要不同接口。准备任务时应明确是需要文字、声音还是连续交互,再确认型号支持的格式和工作方式。
实际使用时重点看什么
音频时长、语言、采样率和流式方式都可能影响服务使用。使用自己的录音或样稿检查结果,关注延迟与信息完整性。
价格与使用条件
官方使用与计费说明 ↗。在线调用、产品订阅和自行部署的资源成本分别计算,具体以所选服务与模型许可为准。
