基本介绍
ElevenLabs 的模型覆盖文字转语音、语音识别、音色设计、声音转换、音效和音乐。它既适合配音与音频制作,也可以成为语音助手中的声音组件。生成声音与识别声音属于不同任务。
配音、实时对话和转写
配音更关注发音、停顿与情绪,实时交互还要求及时响应;Scribe 把录音转换成文本,用于字幕或资料整理。音色设计和声音转换也有独立模型,不能与文字转语音混用参数。
怎样判断音频质量
使用包含数字、姓名、缩写和长句的真实样稿试听,比只试听一句宣传语更有参考价值。多语言任务应检查目标语言发音,医疗等专用转写仍需对照原音频核实术语。
模型与版本目录
AI音频 · 19 项
| 模型与版本 | 完整标识 | 版本状态 |
|---|---|---|
| ElevenLabs eleven_english_sts_v2 | eleven_english_sts_v2 | 官方目录收录 |
| ElevenLabs eleven_flash_v2 | eleven_flash_v2 | 官方目录收录 |
| ElevenLabs eleven_flash_v2_5 | eleven_flash_v2_5 | 官方目录收录 |
| ElevenLabs eleven_multilingual_sts_v2 | eleven_multilingual_sts_v2 | 官方目录收录 |
| ElevenLabs eleven_multilingual_ttv_v2 | eleven_multilingual_ttv_v2 | 官方目录收录 |
| ElevenLabs eleven_multilingual_v2 | eleven_multilingual_v2 | 官方目录收录 |
| ElevenLabs eleven_text_to_sound_v2 | eleven_text_to_sound_v2 | 官方目录收录 |
| ElevenLabs eleven_ttv_v3 | eleven_ttv_v3 | 官方目录收录 |
| ElevenLabs eleven_v3 | eleven_v3 | 官方目录收录 |
| ElevenLabs eleven_v3_conversational | eleven_v3_conversational | 官方目录收录 |
| ElevenLabs music_v1 | music_v1 | 官方目录收录 |
| ElevenLabs music_v2 | music_v2 | 官方目录收录 |
| ElevenLabs music_v2_5 | music_v2_5 | 官方目录收录 |
| ElevenLabs scribe_v2 | scribe_v2 | 官方目录收录 |
| ElevenLabs scribe_v2_medical | scribe_v2_medical | 官方目录收录 |
| ElevenLabs scribe_v2_realtime | scribe_v2_realtime | 官方目录收录 |
| ElevenLabs eleven_turbo_v2 | eleven_turbo_v2 | 已弃用:保留版本资料 |
| ElevenLabs eleven_turbo_v2_5 | eleven_turbo_v2_5 | 已弃用:保留版本资料 |
| ElevenLabs scribe_v1 | scribe_v1 | 已弃用:保留版本资料 |
价格与使用条件
官方价格与使用条件 ↗。产品订阅、按量调用与自行部署具有不同成本,选择前结合任务量和所需功能计算。