模型简介
MAI-Transcribe-1 是Microsoft AI的语音识别模型,将语音内容转换为文本,适用于字幕、录音整理和语音交互中的转写环节。
MAI 是 Microsoft AI 的模型系列,涵盖推理、代码、语音和图像等方向。
这个版本怎样理解
这里记录的是官方公开的产品型号或版本名称。程序接入时还需查看对应平台要求的参数,不能把显示名称直接当成所有服务通用的 API 标识。
版本与模型标识
| 模型名称 | MAI-Transcribe-1 |
|---|---|
| 标识类型 | 官方公开名称 |
| 完整型号 / 标识 | MAI-Transcribe-1 |
| 版本状态 | 官方目录收录 |
用真实录音检查识别
准备含有背景噪声、多人说话、专业名词和数字的录音,检查转写与原声是否一致。会议整理还应关注说话人和时间定位,以便回听和纠正。
实际使用时重点看什么
语音识别输出的是声音中的文字,不等于对内容完成了事实核实。专有名称与关键数字应重点复核,领域专用转写也应保留人工校对环节。
价格与使用条件
官方使用与计费说明 ↗。在线调用、产品订阅和自行部署的资源成本分别计算,具体以所选服务与模型许可为准。