Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

officechai+1saascity+1officechai+1DeepReinforce veröffentlichte am 19. August 2026 Ornith-1.5, eine Familie von Open-Weight-Sprachmodellen in drei Größen, 397B, 35B und 9B Parameter, die laut Unternehmensangaben bei mehreren Coding- und Reasoning-Benchmarks mit Anthropic:s Claude Opus 4.8 gleichzieht oder diese übertrifft. Die Modelle werden unter der MIT-Lizenz auf Hugging Face bereitgestellt, was eine uneingeschränkte kommerzielle Nutzung ermöglicht.officechai+1
Das Flaggschiff Ornith-1.5-397B, ein Mixture-of-Experts-Modell, erzielt laut den veröffentlichten Ergebnissen von DeepReinforce 86,1 Punkte bei Terminal-Bench 2.1 und 86 bei SWE-Bench Verified, verglichen mit den von Claude Opus 4.8 gemeldeten 85 und 85,8 in denselben Tests. Bei DeepSWE, einem schwierigeren agentenbasierten Coding-Benchmark, erzielte das Modell 56 Punkte, ein großer Sprung von 8 bei der vorherigen Ornith-1.0-Veröffentlichung, liegt jedoch immer noch unter den 59 Punkten von Claude Opus 4.8 im gleichen Test. Bei Frontier-Bench v0.1 liegt das Modell mit 13,5 Punkten deutlicher hinter den gemeldeten 21,1 von Claude Opus 4.8.saascity+2
Die Architektur erweitert das Konzept des "Self-Scaffolding" von Ornith-1.0 zu einer vollständigen Selbstverbesserungsschleife: Das Modell schlägt eigene Trainingsaufgaben vor, schreibt aufgabenspezifische Gerüste und generiert Reinforcement-Learning-Rollouts, die in das Training zurückfließen. Die 35B MoE-Variante aktiviert nur etwa 3 Milliarden Parameter pro Token, während das dichte 9B-Modell mit einer quantisierten "Mobile"-Version geliefert wird, die für die Nutzung auf dem Gerät auf etwa 1,5 GB komprimiert ist.officechai+2
DeepReinforce wurde von Dr. Jiwei Li gegründet, einem Stanford-Doktor der Informatik, der auf die Liste der Innovators Under 35 der MIT Technology Review gesetzt wurde. Das Labor baute seinen Ruf zunächst mit CUDA-L1 und CUDA-L2 auf, Reinforcement-Learning-Frameworks zur Optimierung von CUDA-Code, bevor am 25. Juni 2026 Ornith-1.0 veröffentlicht wurde. Diese erste Version basierte auf Qwen 3.5 von Alibaba Group Holding Limited mit zusätzlichem Pre-Training und Post-Training.kie+1
Die Veröffentlichung erfolgt zu einer Zeit, in der chinesische und mit China verbundene Labore den Rückstand zu US-amerikanischen Spitzenmodellen bei Open Weights weiter verringern. Alibabas Qwen und DeepSeek haben in den letzten Monaten ähnliche Ansprüche erhoben, und Open-Weight-Veröffentlichungen vergleichen sich zunehmend mit geschlossenen Modellen anstatt nur untereinander. Alle Ornith-1.5-Varianten sind auf Hugging Face mit FP8, GGUF, MLX und NVFP4 quantisierten Varianten verfügbar und können über Ollama, LM Studio und AtomicChat ausgeführt werden.datanorth+1