次浏览

fun-asr-mtl-2025-08-25

AI 资源
AI音频AI模型与工具导航

更新时间:

fun-asr-mtl-2025-08-25 是阿里巴巴 / 阿里云的语音识别模型,将语音内容转换为文本,适用于字幕、录音整理和语音交互中的转写环节。

资源信息

所属机构
阿里巴巴 / 阿里云
适用对象
语音产品、音频创作者与应用开发者

fun-asr-mtl-2025-08-25 资源介绍

模型简介

fun-asr-mtl-2025-08-25 是阿里巴巴 / 阿里云的语音识别模型,将语音内容转换为文本,适用于字幕、录音整理和语音交互中的转写环节。

这个型号的模式为 非实时;API为 HTTP;精度增强为 热词。通义千问 Qwen 是阿里巴巴的模型家族,同时提供云端服务与多种开放权重。

这个版本怎样理解

名称中的日期或发布后缀用于区分具体版本。记录完整标识有助于复现调用,切换到同系列其他日期版本时,仍应检查输出格式、限制和服务状态。

版本与模型标识

模型名称fun-asr-mtl-2025-08-25
模型 / 资源标识fun-asr-mtl-2025-08-25
版本标识fun-asr-mtl-2025-08-25
版本状态官方目录收录

能力与参数

模式非实时
APIHTTP
精度增强热词
情感识别不支持
说话人分离支持
支持语言多语种及方言
音频最大时长/大小12小时 / 2GB

用真实录音检查识别

准备含有背景噪声、多人说话、专业名词和数字的录音,检查转写与原声是否一致。会议整理还应关注说话人和时间定位,以便回听和纠正。

实际使用时重点看什么

语音识别输出的是声音中的文字,不等于对内容完成了事实核实。专有名称与关键数字应重点复核,领域专用转写也应保留人工校对环节。

价格与计费说明

查看官方计费与使用条件 ↗。API、产品订阅与自行部署是不同使用方式;开放权重不等于免费托管调用。

官方网址与文档

同厂商模型

查看通义千问 Qwen 模型完整目录与版本说明

资料来源

型号、版本与参数依据以上官方公开资料整理。

GEO导航 · AI 资源发现适合你的 AI 工具

探索工具分类,了解功能与应用场景。

GEO优化知识

更多