模型简介
ElevenLabs eleven_multilingual_sts_v2 是ElevenLabs的声音转换模型,以声音为处理对象,参与音色转换或语音表现调整。
ElevenLabs 的模型覆盖文字转语音、语音识别、音色设计、声音转换、音效和音乐。
这个版本怎样理解
使用时以完整型号 eleven_multilingual_sts_v2 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
版本与模型标识
| 模型名称 | ElevenLabs eleven_multilingual_sts_v2 |
|---|---|
| 标识类型 | 官方模型标识 |
| 完整型号 / 标识 | eleven_multilingual_sts_v2 |
| 版本状态 | 官方目录收录 |
检查内容与声音表现
使用清晰的原始语音,关注转换后是否保留话语内容、节奏和停顿。背景噪声、重叠说话和过短片段都可能影响判断,应分别准备样例试听。
实际使用时重点看什么
声音身份、合成模型和输入音频属于不同条件。比较版本时尽量保持输入相同,检查吐字与细节,而不是只听第一印象。
价格与使用条件
官方使用与计费说明 ↗。在线调用、产品订阅和自行部署的资源成本分别计算,具体以所选服务与模型许可为准。