
Vollständige Dokument- und Repository-Durchläufe
Ein Kontextfenster von 1M Tokens ist nur die halbe Miete bei einer langen Aufgabe; die andere Hälfte ist, die Antwort auch ausschreiben zu dürfen. deepseek-v4.1-flash kombiniert dieses Fenster mit einer Output-Obergrenze von 384.000 Tokens, sodass ein übersetztes Handbuch, eine umgeschriebene Testsuite oder ein klauselweiser Vertragsreview in einer einzigen Antwort zurückkommen kann, statt in Stücke zerlegt, zusammengesetzt und abgeglichen zu werden. Weil deepseek-v4.1-flash bei jeder Kontextlänge gleich viel kostet, überschreitet ein langer Prompt keine Schwelle, die die Rate mitten in der Aufgabe ändert. Setze max_tokens bei solchen Aufgaben bewusst — sonst verwendet deepseek-v4.1-flash den Endpunkt-Standard statt der Obergrenze.
API-Dokumentation lesen




