Alle Depeschen

DepescheModelle

DeepSeek stellt ein experimentelles Vision-Modell in die API – 384 Token je Bild, bis zu 600 Bilder je Anfrage

Seit dem 21. August 2026 steht in DeepSeeks API das Modell „deepseek-v4-flash-vision-exp“: V4 Flash mit Bildeingabe. Laut DeepSeeks eigener Dokumentation kostet ein Bild pauschal 384 Token, erlaubt sind bis zu 600 Bilder je Anfrage bei höchstens 8.192 px Kantenlänge – ab 15 Bildern in einer Anfrage sinkt das auf 4.096 px; Formate sind JPEG, PNG, GIF und WebP. Preislich liegt das Modell exakt auf dem Niveau des Text-Modells V4 Flash: 0,22 US-Dollar Eingabe und 0,66 Ausgabe je 1 Mio. Token außerhalb der Stoßzeiten, 0,44 und 1,32 während der Peak-Fenster.

Die belastbaren Angaben stammen aus DeepSeeks Entwicklerdokumentation, die wir selbst geöffnet haben. Dort steht die Modell-ID „deepseek-v4-flash-vision-exp“ samt Limits: „384 tokens per image“, maximal 600 Bilder je Anfrage und „8192 px per side; drops to 4096 px per side when a request contains 15 or more images“. Unterstützt werden JPEG, PNG, GIF und WebP.

Die Preisseite führt das Modell als dritte Zeile neben „deepseek-v4-flash“ und „deepseek-v4-pro“ – mit identischen Werten zum Text-Flash: Cache-Treffer 0,007 (off-peak) beziehungsweise 0,014 US-Dollar (peak), Cache-Fehltreffer 0,22 / 0,44 und Ausgabe 0,66 / 1,32 US-Dollar je 1 Mio. Token. Kontextlänge 1 Mio. Token, maximale Ausgabe 384K. Es gilt dieselbe Zeitstaffel, die DeepSeek am 16. August eingeführt hat: „Peak hours are 01:00 - 04:00 and 06:00 - 10:00 UTC (all other hours are off-peak)“ – der europäische Vormittag ist also das teure Fenster.

Vercel hat das Modell am selben Tag in sein AI Gateway aufgenommen und schreibt dazu ausdrücklich: „The `-exp` in the model ID marks this as an experimental release.“ Einen Preis nennt das Changelog nicht.

⚠️ Nicht übernommen haben wir die Leistungsbehauptung. Die deutsche Rezeption schreibt, das Modell reiche bei multimodalen Agenten-Benchmarks „fast an das Niveau von Opus-4.8“ heran und übertreffe es teils. Diese Aussage stammt aus einem X-Beitrag von DeepSeek; x.com ist für unseren Abruf gesperrt, und in der Dokumentation steht auf gezielte Nachfrage weder ein Benchmark noch eine Zahl. Es gibt damit keine prüfbare Grundlage – auch keine anbieter-selbstberichtete, die wir zitieren könnten.

⚠️ Ebenfalls offen: Ob und wann Gewichte erscheinen. Weder die Dokumentation noch DeepSeeks News-Seite sagen dazu etwas; das Modell ist bislang nur als API-Endpunkt belegt. Wir legen es deshalb nicht als Katalog-Entität an – V4 Flash steht auch als Text-Modell nicht im Modellkatalog, geführt ist dort V4 Pro.