次浏览

Gemini 3.5 Live Translate

AI 资源
AI音频AI模型与工具导航

更新时间:

Gemini 3.5 Live Translate 是Google DeepMind的音频模型,处理声音相关输入或输出,参与音频理解、生成与交互任务。

资源信息

所属机构
Google DeepMind
适用对象
语音产品、音频创作者与应用开发者

Gemini 3.5 Live Translate 资源介绍

模型简介

Gemini 3.5 Live Translate 是Google DeepMind的音频模型,处理声音相关输入或输出,参与音频理解、生成与交互任务。

这个型号的最大输入为 131,072 tokens;最大输出为 65,536 tokens;输入为 音频 (speech)。这个分支在系列中采用较紧凑或轻量的定位。固定格式、明确材料和范围清楚的任务便于测试其实际表现;是否适合部署,还需结合资源条件和业务复杂度判断。

这个版本怎样理解

使用时以完整型号 gemini-3.5-live-translate-preview 为准。同一系列的其他版本可能改变输入范围、默认行为或运行配置,升级前可先对照下方参数与官方说明。

版本与模型标识

模型名称Gemini 3.5 Live Translate
模型 / 资源标识gemini-3.5-live-translate-preview
版本标识gemini-3.5-live-translate-preview
版本状态预览版本

能力与参数

最大输入131,072 tokens
最大输出65,536 tokens
输入音频 (speech)
输出音频 (translated speech) 文本 (transcript)

先确认输入输出方向

识别音频、生成语音和实时对话需要不同接口。准备任务时应明确是需要文字、声音还是连续交互,再确认型号支持的格式和工作方式。

实际使用时重点看什么

音频时长、语言、采样率和流式方式都可能影响服务使用。使用自己的录音或样稿检查结果,关注延迟与信息完整性。

价格与计费说明

查看官方计费与使用条件 ↗。API、产品订阅与自行部署是不同使用方式;开放权重不等于免费托管调用。

官方网址与文档

同厂商模型

查看Google Gemini 模型完整目录与版本说明

资料来源

型号、版本与参数依据以上官方公开资料整理。

GEO导航 · AI 资源发现适合你的 AI 工具

探索工具分类,了解功能与应用场景。

GEO优化知识

更多