模型简介
GLM-ASR-2512 是智谱 Z.ai的语音识别模型,将语音内容转换为文本,适用于字幕、录音整理和语音交互中的转写环节。
智谱 GLM 是面向语言、代码和多模态任务的模型家族,开发者可通过智谱开放平台等入口接入。
这个版本怎样理解
名称中的日期或发布后缀用于区分具体版本。记录完整标识有助于复现调用,切换到同系列其他日期版本时,仍应检查输出格式、限制和服务状态。
版本与模型标识
| 模型名称 | GLM-ASR-2512 |
|---|---|
| 模型 / 资源标识 | glm-asr-2512 |
| 版本标识 | glm-asr-2512 |
| 版本状态 | 官方目录收录 |
能力与参数
| 上下文 | |
|---|---|
| 最大输出 |
用真实录音检查识别
准备含有背景噪声、多人说话、专业名词和数字的录音,检查转写与原声是否一致。会议整理还应关注说话人和时间定位,以便回听和纠正。
实际使用时重点看什么
语音识别输出的是声音中的文字,不等于对内容完成了事实核实。专有名称与关键数字应重点复核,领域专用转写也应保留人工校对环节。
价格与计费说明
查看官方计费与使用条件 ↗。API、产品订阅与自行部署是不同使用方式;开放权重不等于免费托管调用。
官方网址与文档
同厂商模型
- GLM-TTS · 官方目录收录
- GLM-TTS-Clone · 官方目录收录
- GLM-Realtime · 官方目录收录
- GLM-4-Voice · 官方目录收录
资料来源
型号、版本与参数依据以上官方公开资料整理。
