模型简介
LongCat-AudioDiT-1B 是美团 Meituan的音效生成模型,依据声音描述制作音频素材,适合环境声、动作声与视听内容的声音设计。
LongCat 是美团发布的模型系列,公开项目覆盖语言及多模态方向。
这个版本怎样理解
使用时以完整型号 meituan-longcat/LongCat-AudioDiT-1B 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
版本与模型标识
| 模型名称 | LongCat-AudioDiT-1B |
|---|---|
| 标识类型 | 官方权重仓库标识 |
| 完整型号 / 标识 | meituan-longcat/LongCat-AudioDiT-1B |
| 版本状态 | 开放权重 |
描述声源与环境
说明声源、发生动作、空间和持续方式,例如远近、干湿和是否循环。生成后结合画面试听,检查起止、节奏和背景噪声是否符合制作要求。
实际使用时重点看什么
音效与配音、歌曲的评价方式不同。除声音质感外,还应检查能否剪辑、循环或与已有音轨混合,必要时在音频工具中继续处理。
价格与使用条件
官方使用与计费说明 ↗。在线调用、产品订阅和自行部署的资源成本分别计算,具体以所选服务与模型许可为准。