Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

marktechpost+1neowin+1moomoo+1Das Qwen-Team von Alibaba hat am Freitag Qwen3.8-Omni-Flash veröffentlicht, ein natives omnimodales KI-Modell, das Text, Bild, Audio und Video über eine einzige Architektur mit einem Kontextfenster von 1 Million Token verarbeitet. Der Start ließ die in Hongkong notierten Aktien von Alibaba im frühen Handel um mehr als 4% steigen.moomoo
Das Modell, das auf der Qwen3.8-Flash-Next-Architektur basiert, die im August mit offenen Gewichten erschien, markiert einen Wandel von passiver Multimedia-Verarbeitung hin zu sogenannten agentischen Fähigkeiten: der Fähigkeit, Aufgaben zu planen, externe Tools aufzurufen und Arbeitsabläufe basierend auf audiovisuellen Eingaben auszuführen.marktechpost+2
Qwen3.8-Omni-Flash unterbietet die Konkurrenz bei den Kosten. Die API-Preise für stündliche Audio-Eingaben sind im Vergleich zum Vorgänger Qwen3.5-Omni-Plus um mehr als 98% gesunken, während die Kosten für audiovisuelle Eingaben um über 93% fielen. QwenCloud listet das Modell mit 0,15 USD pro Million Input-Token und 0,47 USD pro Million Output-Token, ein Bruchteil dessen, was Alphabet Inc. für Gemini in vergleichbaren Stufen berechnet.neowin+3
Über 29 interne Benchmarks hinweg meldete Alibaba eine durchschnittliche Leistungssteigerung von über 25% gegenüber Qwen3.5-Omni-Plus. Beim OmniVideoBench stieg die Genauigkeit von 63,4 auf 67,8, während der Token-Verbrauch um 45,7% von 145.736 auf 79.117 Token sank. Unabhängige Benchmark-Ergebnisse waren zum Start nicht verfügbar.marktechpost+2
Das Modell ist auf QwenCloud, Alibaba Cloud Model Studio und der Qwen-Chat-Oberfläche in sechs Regionen live: Peking, Singapur, Hongkong, Tokio, Frankfurt und Virginia. Es unterstützt das OpenAI-kompatible API-Protokoll, Funktionsaufrufe, Websuche und strukturierte Ausgaben.alibabacloud+1
Bemerkenswert ist, dass Qwen3.8-Omni-Flash nur Text ausgibt. Entwickler, die generierte Sprache benötigen, werden auf das ältere Modell Qwen3.5-Omni verwiesen. Es wurden keine offenen Gewichte veröffentlicht, was ein Self-Hosting derzeit unmöglich macht. Parallel dazu hat Alibaba Qwen-MM-Plugins unter einer Apache 2.0-Lizenz als Open Source veröffentlicht, ein Toolkit, mit dem Agenten-Frameworks die multimodalen Fähigkeiten des Modells als installierbare Skills integrieren können.marktechpost+2
Die Veröffentlichung erfolgt zu einer Zeit, in der chinesische KI-Unternehmen trotz US-Exportbeschränkungen für Chips den Rückstand zu westlichen Konkurrenten weiter verringern, wobei Neowin anmerkt, dass Huawei die Auslieferung seines Ascend 960DT KI-Chips beschleunigt hat.neowin