Sozdai Logo
Gemini

Gemini 3.5 Flash Lite:在线对话与 API

gemini-3.5-flash-lite

Gemini 系列的最轻量档——为单价说了算的大规模流水线而生,却仍带 1M token 上下文。

输入 51 ₽ · 输出 425 ₽ /1M tokens1M 上下文 深度思考 提示缓存
API 密钥
gemini-3.5-flash-lite
打开完整聊天

在这里直接体验

真实模型实时流式输出,注册即送体验积分

相似模型

关于 Gemini 3.5 Flash Lite

Gemini 3.5 Flash Lite 用峰值智能换极致效率:分类、抽取、路由、审核、批量聊天,价格让百万级调用成为日常。

难得的是这个价位仍保留 1M token 上下文与原生图像输入,自动缓存零配置为重复前缀打折。

在 Sozdai,一个账号一个积分余额即可两种方式使用 Gemini 3.5 Flash Lite:在本页浏览器体验区直接对话,或通过 OpenAI 兼容端点编程调用。计费纯按 token 用量,无订阅。

为什么选 Gemini 3.5 Flash Lite

为大规模而生

单位经济性让百万级调用流水线成为常规操作,批量负载的默认选择。

最低档也有 1M 上下文

超大输入与长文档在最轻量的模型上也是一次调用。

OpenAI 兼容 API

把现有 OpenAI SDK 的 base URL 指过来即可用——流式、工具调用、用量统计齐全。

自动提示缓存

重复的提示前缀由上游自动缓存,按输入价的零头计费,无需任何参数——agent 和 RAG 场景直接省钱。

一个余额通用

网页对话和 API 共用同一积分余额,按 token 透明计费,无订阅无门槛。

规格参数

模型 IDgemini-3.5-flash-lite
所属系列Gemini
类型LLM
上下文窗口1M tokens
输入价格51 ₽ / 1M tokens
输出价格425 ₽ / 1M tokens
缓存读价格5,1 ₽ / 1M tokens
深度思考支持
提示缓存支持
API 兼容性OpenAI SDK + Anthropic 原生 /v1/messages
流式输出支持

三步完成接入

1

创建 API 密钥

注册后进控制台签发密钥,送体验积分,无需绑卡。

2

SDK 指向 Sozdai

把 base URL 换成我们的端点,model 填 \"gemini-3.5-flash-lite\",现有 OpenAI SDK 代码无需其他改动。

3

上线并监控

生产环境流式输出,在用量日志里查看每次请求的 token 数与费用。

常见问题

不写代码能体验 Gemini 3.5 Flash Lite 吗?+

可以——本页的体验区就是真实模型。注册领体验积分即可对话,同一账号之后可直接用 API。

API 兼容 OpenAI SDK 吗?+

兼容。任意 OpenAI SDK(Python/Node 等)换 base URL 即可,流式与工具调用齐全。

怎么计费?+

纯按 token 用多少付多少,价格本页可见,从积分余额扣费(1 积分=$0.01)。缓存命中大幅折扣,无订阅。

支持思考/推理吗?+

支持——可按请求开启轻量推理,但模型为快速通过优化。

上下文窗口多大?+

1M token——这个价位罕见的窗口。