模型简介
Stable Audio 2.5 是Stability AI的音效生成模型,依据声音描述制作音频素材,适合环境声、动作声与视听内容的声音设计。
这个型号的音频生成时长为 最长 3 分钟。Stability AI 的生成模型覆盖图像和音频。
这个版本怎样理解
这里记录的是官方公开的产品型号或版本名称。程序接入时还需查看对应平台要求的参数,不能把显示名称直接当成所有服务通用的 API 标识。
版本与模型标识
| 模型名称 | Stable Audio 2.5 |
|---|---|
| 标识类型 | 官方公开名称 |
| 完整型号 / 标识 | Stable Audio 2.5 |
| 版本状态 | 官方目录收录 |
能力与参数
| 音频生成时长 | 最长 3 分钟 |
|---|
描述声源与环境
说明声源、发生动作、空间和持续方式,例如远近、干湿和是否循环。生成后结合画面试听,检查起止、节奏和背景噪声是否符合制作要求。
实际使用时重点看什么
音效与配音、歌曲的评价方式不同。除声音质感外,还应检查能否剪辑、循环或与已有音轨混合,必要时在音频工具中继续处理。
价格与使用条件
官方使用与计费说明 ↗。在线调用、产品订阅和自行部署的资源成本分别计算,具体以所选服务与模型许可为准。