Sozdai Logo
DeepSeek

DeepSeek V4 Flash:在线对话与 API

deepseek-v4-flash

DeepSeek 的效率型模型——极低的 token 单价换来相当能打的输出,自动缓存,1M 上下文。

输入 35,7 ₽ · 输出 71,4 ₽ /1M tokens1M 上下文 深度思考 提示缓存
API 密钥
deepseek-v4-flash
打开完整聊天

在这里直接体验

真实模型实时流式输出,注册即送体验积分

相似模型

关于 DeepSeek V4 Flash

当单位成本说了算,DeepSeek V4 Flash 就是默认答案:摘要、抽取、分类、聊天和批量流水线,用全平台最低价拿到真正可用的输出。

自动提示缓存无需参数、进一步压低重复上下文成本;1M token 上下文让再大的输入也是一次调用。

在 Sozdai,一个账号一个积分余额即可两种方式使用 DeepSeek V4 Flash:在本页浏览器体验区直接对话,或通过 OpenAI 兼容端点编程调用。计费纯按 token 用量,无订阅。

为什么选 DeepSeek V4 Flash

全平台最低成本

极低的 token 单价,让高频流水线从昂贵变成不值一提。

超出价位的能力

日常推理、编码、写作的表现远好于价格暗示的水平。

OpenAI 兼容 API

把现有 OpenAI SDK 的 base URL 指过来即可用——流式、工具调用、用量统计齐全。

自动提示缓存

重复的提示前缀由上游自动缓存,按输入价的零头计费,无需任何参数——agent 和 RAG 场景直接省钱。

一个余额通用

网页对话和 API 共用同一积分余额,按 token 透明计费,无订阅无门槛。

规格参数

模型 IDdeepseek-v4-flash
所属系列DeepSeek
类型LLM
上下文窗口1M tokens
输入价格35,7 ₽ / 1M tokens
输出价格71,4 ₽ / 1M tokens
缓存读价格0,765 ₽ / 1M tokens
深度思考支持
提示缓存支持
API 兼容性OpenAI SDK + Anthropic 原生 /v1/messages
流式输出支持

三步完成接入

1

创建 API 密钥

注册后进控制台签发密钥,送体验积分,无需绑卡。

2

SDK 指向 Sozdai

把 base URL 换成我们的端点,model 填 \"deepseek-v4-flash\",现有 OpenAI SDK 代码无需其他改动。

3

上线并监控

生产环境流式输出,在用量日志里查看每次请求的 token 数与费用。

常见问题

不写代码能体验 DeepSeek V4 Flash 吗?+

可以——本页的体验区就是真实模型。注册领体验积分即可对话,同一账号之后可直接用 API。

API 兼容 OpenAI SDK 吗?+

兼容。任意 OpenAI SDK(Python/Node 等)换 base URL 即可,流式与工具调用齐全。

怎么计费?+

纯按 token 用多少付多少,价格本页可见,从积分余额扣费(1 积分=$0.01)。缓存命中大幅折扣,无订阅。

支持思考/推理吗?+

支持——需要深想时可按请求开启推理。

上下文窗口多大?+

1M token——超大输入一次调用完成。