模型简介
Lyria 3.5 是Google DeepMind的音乐生成模型,围绕音乐内容的生成或改编展开,适合创作草稿、风格探索与音乐素材制作。
这个型号的最大输入为 131,072 tokens;输入为 文本 图片;输出为 音频 (MP3), 文本 (Lyrics)。Gemini 是 Google DeepMind 的多模态模型系列,面向文本、图片、音频、视频理解及应用开发。
这个版本怎样理解
使用时以完整型号 lyria-3.5 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。
版本与模型标识
| 模型名称 | Lyria 3.5 |
|---|---|
| 模型 / 资源标识 | lyria-3.5 |
| 版本标识 | lyria-3.5 |
| 版本状态 | 官方目录收录 |
能力与参数
| 最大输入 | 131,072 tokens |
|---|---|
| 输入 | 文本 图片 |
| 输出 | 音频 (MP3), 文本 (Lyrics) |
表达音乐而不只写主题
可以分别说明速度感、乐器、人声和段落结构,再检查生成内容是否符合预期。涉及歌词时逐句听辨,注意重复、吞字和段落衔接,保留需要修改的位置。
实际使用时重点看什么
评价一段音乐时,应同时听旋律、节奏、配器与整体结构。产品订阅、API 与开放权重的使用条件可能不同,应按实际入口理解作品和服务规则。
价格与计费说明
查看官方计费与使用条件 ↗。API、产品订阅与自行部署是不同使用方式;开放权重不等于免费托管调用。
官方网址与文档
同厂商模型
- Gemini 3.5 Live Translate · 预览版本
- Gemini 3.1 Flash Live · 预览版本
- Gemini 3.1 Flash TTS · 预览版本
- Gemini 3.5 Transcribe · 官方目录收录
- Gemini 3.5 Transcribe Live · 官方目录收录
- Gemini 2.5 Flash Live · 预览版本
- Gemini 2.5 Flash TTS · 预览版本
- Gemini 2.5 Pro TTS · 预览版本
资料来源
型号、版本与参数依据以上官方公开资料整理。