首页模型市场Gemini 3.5 Flash
G

gemini-3.5-flash

对话/推理代码服务正常

Gemini 3.5 Flash 是谷歌(Google)推出的高速多模态大语言模型,专为低延迟、高并发与大规模部署场景设计,在保持优秀理解能力的同时,大幅提升了响应速度与调用效率,是性价比极高的 Gemini 系列模型。Flash 版本原生支持文本与图像的多模态理解,能够快速完成对话生成、文档摘要、信息抽取、图像识别与轻量级代码任务。借助超长上下文窗口,模型可一次性处理长篇文档、大量数据与多轮对话,并保持连贯稳定的输出质量,即便在高频调用场景下依然表现可靠。

输入0.75/1M1.5/1M/1M
输出4.5/1M9/1M/1M
缓存输入/1M
缓存读取0.075/1M0.15/1M/1M
API 接入
Playground *使用真实模型参数
登录后可直接试跑,下面的表单会按该模型参数 schema 自动渲染。去登录 →
还没有试跑记录,发送第一条请求吧。
Live — 真实试跑
试跑结果会显示在左侧表单下方
表单、轮询状态、错误提示和 cURL 均复用现有真实 Playground 逻辑。

模型介绍

Gemini 3.5 Flash