
整份文档与整个代码库,一次处理完
1M token 的上下文窗口只解决了长任务的一半,另一半是要能把答案完整写出来。deepseek-v4.1-flash 把这个窗口和 384,000 token 的输出上限配在一起,所以一份翻译好的手册、一套重写过的测试套件,或者一份逐条审查的合同,都能在一次响应里返回,而不用先拆块、再拼接、再校对。因为 deepseek-v4.1-flash 在任意上下文长度下的价格都一样,长提示词不会在任务中途跨过某个门槛导致费率变化。这类任务要主动设置 max_tokens——否则 deepseek-v4.1-flash 会使用端点默认值,而不是这个上限。
阅读 API 文档




