Google · 音频

Gemini 3.1 Flash Text-to-Speech

文本生成音效语音

Gemini 3.1 Flash Text-to-Speech generates expressive multi-speaker audio from text with voice and language controls.

起€0.40每次生成

示例

规格

类型text-to-audio
输出音频
输入文本
模型 IDgoogle/gemini-3.1-flash/text-to-speech

相似模型

全部模型 →

价格按每次生成计算,仅在生成成功时从余额扣款。生成失败会自动退款。示例展示的是模型的能力;实际结果取决于你的提示词和设置。