V4.1 Flash kommt ins staatliche Supercomputer-Netz Chinas
Am Tag der Premiere war das Modell im nationalen Zentrum des Supercomputer-Internets verfügbar. Wer sich auf der offiziellen Website anmeldet, öffnet dort die Modell-Dienste und startet die API-Aufrufe für V4.1 Flash.

DeepSeek V4.1 Flash ist am 10. September 2026, dem Tag der Premiere, im staatlichen Zentrum des nationalen Supercomputer-Internets bereitgestellt worden. Das meldet das chinesische Portal ITHome. Wer sich auf der offiziellen Website anmeldet, geht in den Bereich der Modell-Dienste und öffnet von dort die Schnittstelle für API-Aufrufe von V4.1 Flash. Das Modell ist damit nicht nur bei kommerziellen Anbietern zu finden, sondern gelangt in die öffentliche Infrastruktur.
ITHome beschreibt das Modell mit Angaben, die sich mit dem Datenblatt des Herstellers decken: 552 Milliarden Parameter in einer Mixture-of-Experts-Architektur, eine neue Struktur Causal-Encoder-Decoder, dazu eine Asymmetrie von Eingang und Ausgang mit 8 Milliarden aktiven Parametern am Eingang und 16 Milliarden am Ausgang. Die Kosten liegen deutlich unter denen vergleichbar großer Modelle. Nach einem Reinforcement-Training in größerem Umfang überholte das Modell in Vergleichstests unter anderem das Flaggschiff DeepSeek V4 Pro, wie das Portal hervorhebt.
Für die öffentliche Infrastruktur zählt vor allem der Speicher. Laut ITHome senkt V4.1 Flash den Bedarf an HBM auf ein Viertel und an SSD auf ein Achtel gegenüber der vorherigen Generation. In Agenten-Szenarien macht der Anteil der Cache-Treffer meist einen großen Teil der Rechnung aus. Die Kompression des KV-Cache senkt also direkt die Kosten für solche Aufgaben. In einer geteilten Infrastruktur zählt genau das am meisten.
Warum das mehr ist als eine Marketingmitteilung
Den Hintergrund dieser Entscheidung beschreibt eine unabhängige Analyse von CorCom vom 7. September 2026. Die Autoren der Bank Lombard Odier argumentieren, dass chinesische Anbieter ihren Vorsprung nicht nur beim Preis der Modelle aufbauen, sondern auch bei der Verfügbarkeit von Energie und beim Tempo des Ausbaus von Rechenleistung. Das amerikanische Ökosystem behält seinen Vorsprung bei den schwierigsten Aufgaben, bei der Cloud-Infrastruktur und bei proprietären Daten. Der Wert in der Kette wandert dagegen schrittweise zu den Halbleitern und den Betreibern großer Maßstäbe.
In diesem Gefüge ist das öffentliche Supercomputer-Netz ein Instrument der Technologiepolitik. Es gibt chinesischen Firmen und Institutionen schnellen Zugang zum Modell, ohne Zwischenhändler und ohne Abhängigkeit von einer ausländischen Cloud. DeepSeek ist dabei nicht der einzige Anbieter. Im selben Zeitraum erscheinen in den chinesischen Fachmedien konkurrierende einheimische Modelle, darunter die Familie GLM-5.3 und Kimi von Moonshot. Dass das Modell in diesem Netz überhaupt verfügbar ist, zeigt jedoch, dass einheimische Modelle als Teil der kritischen Infrastruktur gelten und nicht nur als kommerzielles Produkt.
Für den Endnutzer ist der Unterschied praktisch. Ein im öffentlichen Netz betriebenes Modell übernimmt die Tarife von DeepSeek für Spitzen- und Nebenzeiten. Aufgaben im Batch-Betrieb an freien Tagen kosten also die Hälfte dessen, was zu Zeiten der größten Auslastung anfällt. Die Kombination aus niedrigem Bedarf an HBM und SSD mit dem günstigeren Nachttarif ergibt einen Stückpreis, den Modelle dieser Klasse nicht erreichen, wenn sie ausschließlich in kommerziellen westlichen Clouds laufen. Es ist kein Zufall, dass sich der Wettbewerb um V4.1 Flash in den chinesischen Fachmedien heute nicht um Testergebnisse dreht, sondern um den Preis pro Million Token und um die Verfügbarkeit von Rechenleistung in Spitzenzeiten.
Bei der Interpretation ist dennoch Vorsicht angebracht. Die Anwesenheit des Modells in einem staatlichen Netz bedeutet nicht, dass die gesamte Infrastruktur darunter aus China stammt. Grafikkarten werden weiterhin zum großen Teil importiert, und chinesische Forschungszentren arbeiten intensiv an Varianten einheimischer Beschleuniger. Das öffentliche Supercomputer-Netz ist damit heute vor allem eine Schicht für Zugang und Verteilung, nicht der Beweis vollständiger Hardware-Unabhängigkeit.
Quellen
2Alle Zahlen und Zitate in diesem Text stammen aus den unten genannten Quellen.
Die Materialien wurden vom Redaktionsteam mit Unterstützung von KI erstellt.
Kommentare
0- Noch keine Kommentare — seien Sie der Erste.