模型简介
Deepgram nova 是Deepgram的语音识别模型,将语音内容转换为文本,适用于字幕、录音整理和语音交互中的转写环节。
这个型号的输入 / 输出为 音频 → 文本。Deepgram 提供语音识别等音频模型,Flux 和 Nova 等系列把实时或录制音频转成文字。
这个版本怎样理解
使用时以完整型号 nova 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
版本与模型标识
| 模型名称 | Deepgram nova |
|---|---|
| 标识类型 | 官方模型标识 |
| 完整型号 / 标识 | nova |
| 版本状态 | Legacy 历史系列 |
能力与参数
| 输入 / 输出 | 音频 → 文本 |
|---|
用真实录音检查识别
准备含有背景噪声、多人说话、专业名词和数字的录音,检查转写与原声是否一致。会议整理还应关注说话人和时间定位,以便回听和纠正。
实际使用时重点看什么
语音识别输出的是声音中的文字,不等于对内容完成了事实核实。专有名称与关键数字应重点复核,领域专用转写也应保留人工校对环节。
价格与使用条件
官方使用与计费说明 ↗。在线调用、产品订阅和自行部署的资源成本分别计算,具体以所选服务与模型许可为准。