Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

bloombergfinance.biggo+1finance.biggoDas chinesische Unternehmen DeepSeek hat am Freitag eine öffentliche Beta-Anwendungsprogrammierschnittstelle (API) für sein Modell V4 Flash eingeführt und hob dabei erweiterte Agenten-Fähigkeiten hervor, die laut eigenen Angaben weit über die des leistungsstärkeren Systems V4-Pro-Preview hinausgehen. Dieser Schritt markiert den Übergang von der vorherigen Testphase zu einem breiteren öffentlichen Zugang und verschärft den Preiskampf zwischen chinesischen und US-amerikanischen KI-Laboren.bloomberg
DeepSeek V4 Flash, ein Mixture-of-Experts-Modell mit 284 Milliarden Parametern und 13 Milliarden aktiven Parametern, berechnet 0,14 US-Dollar pro Million Input-Token und 0,28 US-Dollar pro Million Output-Token. Diese Preisgestaltung macht es erheblich günstiger als die durch GPU von NVIDIA Corporation angetriebenen Angebote von OpenAI, selbst nachdem OpenAI die Kosten für sein Modell GPT-5.6 Luna am 30. Juli um 80 Prozent gesenkt hatte, was den Input-Preis von Luna auf 0,20 US-Dollar pro Million Token brachte.finance.biggo+3
Die Ankündigung der öffentlichen Beta war mit einem spezifischen Versprechen bezüglich der Agenten-Leistung verbunden. "Erheblich verbesserte Agenten-Fähigkeiten mit Benchmark-Ergebnissen, die V4-Pro-Preview weit übertreffen", teilte DeepSeek laut Bloomberg in einem Beitrag auf seiner Website mit. Das Modell ging am 24. April erstmals mit MIT-lizenzierten offenen Gewichten und einem Kontextfenster von einer Million Token in die Vorschauphase.api-docs.deepseek+2
Der Zeitpunkt ist bemerkenswert. Nur einen Tag vor der Ankündigung von DeepSeek restrukturierte OpenAI seine eigene Preisgestaltung, um im unteren Preissegment zu konkurrieren: Luna wurde auf 0,20 US-Dollar für Input und 1,20 US-Dollar für Output gesenkt, während das Flaggschiffmodell Sol unverändert bei 5,00 und 30,00 US-Dollar belassen wurde. Doch selbst nach diesen Senkungen unterbietet DeepSeek V4 Flash Luna sowohl beim Input- als auch beim Output-Preis.xenospectrum
Von CNBC zitierte Daten zeigen, dass chinesische Modelle pro Token bis zu neunmal günstiger sein können als US-amerikanische Pendants. Der Anteil der von US-Unternehmen auf chinesischen Modellen verbrauchten Token liegt seit Februar jede Woche bei über 30 Prozent. Ion Stoica, Informatikprofessor an der UC Berkeley und Mitbegründer von Databricks, merkte an, dass sich der Abstand zwischen chinesischen Open-Source-Modellen und Spitzen-Systemen von sechs bis neun Monaten auf nur noch zwei oder drei verringert hat.finance.biggo
Mit der öffentlichen Beta positioniert sich DeepSeek so, dass das Unternehmen Unternehmens-Workloads gewinnen kann, bei denen Kosten vor Markenloyalität gehen. Dies gilt insbesondere für hochvolumige Klassifizierungs-, Extraktions- und Codierungsaufgaben, bei denen der Geschwindigkeitsvorteil von V4 Flash am stärksten ins Gewicht fällt. Da sowohl OpenAI als auch Anthropic im Juni vertraulich Börsengänge beantragt haben, wird der Druck, Margen zu verteidigen und gleichzeitig mit chinesischen Preisen mithalten zu müssen, kurz vor den geplanten Börsengängen weiter steigen.finance.biggo