GPT Image 2.5 is live — OpenAI's newest image model, targeted edits that leave the rest of the frame alone

deepseek-v4.1-flash — 1M 上下文,384K 输出,支持视觉

deepseek-v4.1-flash 是 DeepSeek 的 V4.1-Flash 权重,通过 reAPI 兼容 OpenAI 的 chat 端点提供。deepseek-v4.1-flash 读取 1M token 的上下文窗口,单次响应最多可写出 384,000 token,默认在三档努力度之间思考,并支持文本之外的图片输入。deepseek-v4.1-flash 的当前费率见本页的价格表。

模型特点
1M 上下文 · 最多 384,000 输出 · 视觉 · 默认开启思考
适用场景
长文档、代码库分析、图表与截图阅读
输入
聊天消息、文本和图片(OpenAI 兼容)
输出
文本,支持流式输出
DeepSeek V4.1 Flash

向 DeepSeek V4.1 Flash 提问

直接使用输入框中的默认提示词,或选择一个示例。

Enter 发送 · Shift+Enter 换行

价格

积分计费 — 1 积分 = 0.001 美元,仅为成功生成付费。

首次测试成本
$0.00171.7 credits

最低档一次 1K token 提示加 1K token 回答。

测试预算参考
充值积分
$10
约 5882 次测试
$50
约 29411 次测试
$100
约 58823 次测试
输入
$0.400
价格 · 1M tokens
输出
$1.300
价格 · 1M tokens
缓存读取
$0.015
价格 · 1M tokens

deepseek-v4.1-flash 是什么?

deepseek-v4.1-flash 是 reAPI 通过兼容 OpenAI 的 /api/v1/chat/completions 端点提供 DeepSeek V4.1-Flash 权重的方式。DeepSeek 自家的 Models and Pricing 表给 Flash 系列标注了 1M token 上下文窗口、文档记载的最多 384K 输出 token、视觉、JSON 输出与工具调用,以及思考与非思考两种模式。思考默认在 high 努力度下开启。deepseek-v4.1-flash 在同类模型中不寻常的地方在于输出端:大多数快速档模型的生成上限远低于其上下文窗口,而 deepseek-v4.1-flash 可以一路写到 384,000 token,这正是完整翻译一遍文档或逐文件重构真正需要的量。计费按 token 从你的 reAPI 余额扣取,输入、输出与缓存读取各有各自的费率。

你能用这个模型做什么

可以用这个模型构建并上线的真实工作流与生产级用例。

deepseek-v4.1-flash 一次处理完一份长文档

整份文档与整个代码库,一次处理完

1M token 的上下文窗口只解决了长任务的一半,另一半是要能把答案完整写出来。deepseek-v4.1-flash 把这个窗口和 384,000 token 的输出上限配在一起,所以一份翻译好的手册、一套重写过的测试套件,或者一份逐条审查的合同,都能在一次响应里返回,而不用先拆块、再拼接、再校对。因为 deepseek-v4.1-flash 在任意上下文长度下的价格都一样,长提示词不会在任务中途跨过某个门槛导致费率变化。这类任务要主动设置 max_tokens——否则 deepseek-v4.1-flash 会使用端点默认值,而不是这个上限。

阅读 API 文档
deepseek-v4.1-flash 读取一张图表和一张截图

图表、截图与扫描页面

deepseek-v4.1-flash 在同一个端点、同样的请求结构里接收图片,和文本没有区别。DeepSeek 支持 JPEG、PNG、GIF 和 WebP,格式判断依据文件的实际字节内容,而不是文件名或声明的 MIME 类型,所以标错格式的上传照样能用。给 deepseek-v4.1-flash 发图片可以是内联的 base64 data URL、模型会帮你抓取的公开 http(s) 链接,或者 Files API 的文件句柄。这覆盖了这类工作通常出现的两种形态:本地截图,以及已经在你的流水线里的 URL。

deepseek-v4.1-flash 把一张扫描表单转换成结构化 JSON

抽取结果保持结构化

DeepSeek 把 JSON 输出和工具调用记录为 Flash 权重支持的特性,所以要求 deepseek-v4.1-flash 给出机器可读的输出是一份契约,而不是提示词技巧。结合视觉能力,deepseek-v4.1-flash 适合把扫描发票、仪表盘和表单转换成一行行数据。搭建循环之前值得知道的一点:当请求带上 tools 时,deepseek-v4.1-flash 返回的推理文本必须在后续轮次中原样回传;不带 tools 时它会被忽略,可以直接丢弃。

为什么用 reAPI 调用 DeepSeek V4.1 Flash

输出上限配得上上下文窗口

快速档模型通常会宣传一个很大的上下文窗口,然后把生成上限压低一个数量级。DeepSeek 为 Flash 权重记录的最大输出是 384K token,所以 deepseek-v4.1-flash 能以它读入内容的同等规模把结果写出来。对翻译、重构和长篇结构化抽取来说,这就是一次请求搞定,和要自己动手写、调、调试一套分块流水线之间的区别。

视觉能力在同一个端点上

deepseek-v4.1-flash 用标准的 OpenAI 内容块格式接收图片——没有独立的视觉端点、没有不同的 base URL,也不需要路由到第二个模型 id。图片可以是内联 base64、deepseek-v4.1-flash 会下载的公开 URL,或者一个 Files API 句柄,DeepSeek 依据文件内容而不是文件名来识别格式。给已有的纯文本集成加上图片理解能力,改动的只有消息体本身,别的什么都不用动。

一把 key 用遍平台上所有模型

调用 deepseek-v4.1-flash 的那把 reAPI key 和那份余额,同样可以调用 Claude、GPT、Gemini 和 Kimi 系列。把 deepseek-v4.1-flash 和另一个模型放在一起对比,或者在某家供应商状态不好时切走,只是换一个模型字符串,而不是第二次集成、第二张发票和第二套要轮换的凭证。

deepseek-v4.1-flash 与 GPT-5.6 Luna

对成本敏感、又需要超大上下文窗口的场景来说,这才是真正要做的决策。两者都接受文本和图片,都提供推理努力度调节,所以这次对比的重点不是谁整体更强——而是输出上限、长提示词各自怎么计价,以及你对思考过程能有多少控制权。价格那一行说得很直白:两者之中 Luna 更便宜。

能力
reAPI 上的 deepseek-v4.1-flash
GPT-5.6 Luna
上下文窗口
1M token,DeepSeek 为 Flash 权重记录的数值
1.05M token,OpenAI 记录的数值
最大输出 token
384,000——大约是对方的三倍,也是能够一次响应完成整篇处理的原因
128,000
长提示词计价
任意上下文长度都是同一费率;长提示词不会跨过任何计价门槛
提示词超过文档记录的门槛后,会切换到更高的第二档费率
推理控制
三档——low、high、max,默认 high;其它档位会被接受并映射到这三档上
六档,包含 none,因此思考可以被完全关闭
图片输入
内联 base64、帮你抓取的公开 URL,或 Files API 句柄;格式依据文件内容判断
图片按原始尺寸接受
每 token 费率
输入和输出的费率都高于对方;实时数字见上方价格表
输入和输出的费率都更低

对比基于撰写时 DeepSeek 与 OpenAI 各自文档记录的行为。价格只描述相对关系而非具体金额;实时数字见上方价格表以及各模型自己的页面。

三步用上 deepseek-v4.1-flash

  1. step 01

    创建一把 reAPI key

    注册并在 dashboard 里生成一把 key。新账户会预先到账一些余额,足够你在充值之前发出真实请求、看到真实账单。

    打开
  2. step 02

    把 base URL 指向 reAPI

    继续用你现有的 OpenAI 客户端。把 base URL 换成 reapi.ai/api/v1,模型字符串换成 deepseek-v4.1-flash——deepseek-v4.1-flash 遵循同一份 Chat Completions 契约,所以调用点的其它部分都不用改。

    打开
  3. step 03

    发送 messages 并读取响应

    POST 你的 messages 数组,读取 choices[0].message。deepseek-v4.1-flash 会在 reasoning_content 中随 content 一起返回推理内容,usage 里输入、输出与缓存 token 分别报告。

    打开
docs/api/deepseek-v4-1-flash

API 参考

复制即用的代码片段与完整参数表。

curl https://reapi.ai/api/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4.1-flash",
    "messages": [
      { "role": "user", "content": "Hello" }
    ],
    "reasoning_effort": "high",
    "max_tokens": 8192,
    "stream": true
  }'

参数校验失败

提交时同步拒绝并指明出错字段。检查枚举值、范围与 URL 字段——不产生任何扣费。

认证或余额问题

401 表示 Bearer 密钥缺失或无效;402 表示预扣额超出余额。密钥与积分在控制台管理。

内容或素材被拒

参考素材与生成结果都会经过自动审核。被拒的任务返回明确错误并全额退款。

任务失败或超时

进入失败状态的任务不会扣费——预扣自动退还。保留任务 ID,随时可重试。

常见问题

关于此模型的常见疑问。

deepseek-v4.1-flash 按量从你的 reAPI 余额按 token 计费,输入、输出与缓存读取分别计价,没有订阅。费率不会随上下文长度提高,推理 token 计入输出。当前数字见本页的价格表。

start building

准备好上线了吗?

在 Playground 中试用,或直接获取 API Key 立即接入。