Sozdai Logo
Gemini

Gemini 3.5 Flash:在线对话与 API

gemini-3.5-flash

Google 的高效多模态模型——接近 Pro 级的推理,Flash 级的速度与价格,思考深度可调,1M 上下文。

输入 255 ₽ · 输出 1 530 ₽ /1M tokens1M 上下文 深度思考 提示缓存
API 密钥
gemini-3.5-flash
打开完整聊天

在这里直接体验

真实模型实时流式输出,注册即送体验积分

相似模型

关于 Gemini 3.5 Flash

Gemini 3.5 Flash 以 Flash 级的延迟和成本交付接近 Pro 级的推理与编码,并原生理解图像。

思考深度按请求可调——追求速度用 minimal,难题上 high;隐式缓存自动为重复前缀打折;1M token 上下文大输入一次调用。

在 Sozdai,一个账号一个积分余额即可两种方式使用 Gemini 3.5 Flash:在本页浏览器体验区直接对话,或通过 OpenAI 兼容端点编程调用。计费纯按 token 用量,无订阅。

为什么选 Gemini 3.5 Flash

思考深度可调

从 minimal 到 high 按请求拨档,只在需要时为深度付费。

快速多模态

Flash 级延迟的原生图像理解:截图、文档、照片都能看。

OpenAI 兼容 API

把现有 OpenAI SDK 的 base URL 指过来即可用——流式、工具调用、用量统计齐全。

自动提示缓存

重复的提示前缀由上游自动缓存,按输入价的零头计费,无需任何参数——agent 和 RAG 场景直接省钱。

一个余额通用

网页对话和 API 共用同一积分余额,按 token 透明计费,无订阅无门槛。

规格参数

模型 IDgemini-3.5-flash
所属系列Gemini
类型LLM
上下文窗口1M tokens
输入价格255 ₽ / 1M tokens
输出价格1 530 ₽ / 1M tokens
缓存读价格25,5 ₽ / 1M tokens
深度思考支持
提示缓存支持
API 兼容性OpenAI SDK + Anthropic 原生 /v1/messages
流式输出支持

三步完成接入

1

创建 API 密钥

注册后进控制台签发密钥,送体验积分,无需绑卡。

2

SDK 指向 Sozdai

把 base URL 换成我们的端点,model 填 \"gemini-3.5-flash\",现有 OpenAI SDK 代码无需其他改动。

3

上线并监控

生产环境流式输出,在用量日志里查看每次请求的 token 数与费用。

常见问题

不写代码能体验 Gemini 3.5 Flash 吗?+

可以——本页的体验区就是真实模型。注册领体验积分即可对话,同一账号之后可直接用 API。

API 兼容 OpenAI SDK 吗?+

兼容。任意 OpenAI SDK(Python/Node 等)换 base URL 即可,流式与工具调用齐全。

怎么计费?+

纯按 token 用多少付多少,价格本页可见,从积分余额扣费(1 积分=$0.01)。缓存命中大幅折扣,无订阅。

支持思考/推理吗?+

支持——思考深度按请求可调(reasoning effort),从快速通过到深度推理。

上下文窗口多大?+

1M token——大输入与长会话一次调用。