Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

reutersuniteeconomictimes.indiatimesDas Qwen-Team von Alibaba hat am Mittwoch Qwen3.8-Flash veröffentlicht. Das multimodale KI-Modell bietet eine stärkere Leistung bei Programmier- und Büroaufgaben zu etwa einem Neuntel der Trainingskosten des Vorgängers. Gleichzeitig wurde Qwen3.8-Flash-Next als Open-Source-Modell freigegeben, das einen ersten Ausblick auf die Architektur der kommenden Qwen4-Modellfamilie gibt.
Die doppelte Veröffentlichung unterstreicht, wie sehr Chinas größter Cloud-Computing-Anbieter auf Kosteneffizienz setzt, um seine Führungsposition im sich verschärfenden KI-Wettlauf des Landes zu behaupten, selbst während das Unternehmen die finanzielle Belastung durch hohe Infrastrukturausgaben schultert.
Qwen3.8-Flash unterstützt standardmäßig ein Kontextfenster von 262.144 Token, das auf 1 Million Token erweitert werden kann. Die Preise über die API liegen bei 1 Yuan pro Million Input-Token und 3 Yuan pro Million Output-Token. Im Vergleich zu Qwen3.7-Plus fielen die Trainingskosten laut Alibaba auf etwa ein Neuntel.reuters+1
Qwen3.8-Flash-Next, die experimentelle Open-Source-Version, ist ein Mixture-of-Experts-System mit 125 Milliarden Parametern, das nur 6 Milliarden Parameter pro Token aktiviert, ergänzt durch eine n-Gram-Embedding-Komponente mit 51 Milliarden Parametern. Vom Anbieter veröffentlichte Benchmarks zeigen einen Wert von 62,5 bei SWE-bench Pro im Vergleich zu 53,4 bei Claude Opus 4.6 Max sowie 91,9 bei LiveCodeBench v6 gegenüber 88,8 bei Claude. Die Modellgewichte wurden auf Hugging Face unter der Lizenz qwen-community-1.0 veröffentlicht.tech.yahoo+2
Das Qwen-Team bezeichnete Flash-Next ausdrücklich als Prototyp für die nächste Generation der Qwen4-Familie. Zu den wichtigsten architektonischen Innovationen gehören ein hybrides Attention-Verfahren, das Gated DeltaNet mit Qwen Sparse Attention kombiniert, ein Gated-Residual-Mechanismus sowie die n-Gram-Embedding-Ebene, die Parameter ohne proportionalen Anstieg des Rechenaufwands skaliert. Die Veröffentlichung des Open-Source-Modells war für den 26. August um 23:00 Uhr Pekinger Zeit geplant.technode+2
Die Veröffentlichungen erfolgen nur wenige Tage nach einem stark diskontierten Aktienverkauf von Alibaba in Hongkong im Wert von 80 Milliarden HK-Dollar, mit dem Chips und KI-Infrastruktur finanziert werden sollen. Der Gewinn des Unternehmens im Zeitraum von April bis Juni 2026 brach im Jahresvergleich um 75 % ein, während die Investitionsausgaben vor allem aufgrund von KI-Investitionen um 75 % auf 67,7 Milliarden Yuan stiegen, wie aus einem von Startup Fortune zitierten AP-Bericht hervorgeht. Der Umsatz im Bereich Cloud- und KI-Computing wuchs im selben Quartal um 45 %.economictimes.indiatimes+1
Qwen verzeichnet bereits eine erhebliche Akzeptanz unter Entwicklern. Ein im August 2026 veröffentlichter Bericht von Hugging Face zählte von Januar bis August rund 2,05 Milliarden Qwen-downloads und lag damit deutlich vor Google (418 Millionen) und Meta (227 Millionen).startupfortune