Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

officechai+1saascity+1officechai+1DeepReinforce a lancé Ornith-1.5 le 19 août 2026, une famille de modèles de langage à poids ouverts déclinée en trois tailles (397B, 35B et 9B de paramètres) qui, selon l'entreprise, égale ou surpasse Claude Opus 4.8 d'Anthropic sur plusieurs benchmarks de codage et de raisonnement. Les modèles sont disponibles sous licence MIT sur Hugging Face, permettant une utilisation commerciale sans restriction.officechai+1
Le modèle phare Ornith-1.5-397B, une architecture de mélange d'experts, obtient 86,1 sur Terminal-Bench 2.1 et 86 sur SWE-Bench Verified, contre 85 et 85,8 pour Claude Opus 4.8 sur les mêmes tests, selon les résultats publiés par DeepReinforce. Sur DeepSWE, un benchmark de codage agentique plus difficile, le modèle a obtenu 56, un bond important par rapport aux 8 points de la version précédente Ornith-1.0, bien que toujours inférieur aux 59 points de Claude Opus 4.8. Le modèle est plus nettement distancé sur Frontier-Bench v0.1, avec un score de 13,5 contre 21,1 pour Claude Opus 4.8.saascity+2
L'architecture étend le concept d'auto-échafaudage d'Ornith-1.0 vers ce que DeepReinforce appelle une boucle d'auto-amélioration complète : le modèle propose ses propres tâches d'entraînement, écrit des échafaudages spécifiques aux tâches et génère des déploiements d'apprentissage par renforcement qui réinjectent des données dans l'entraînement. La variante MoE de 35B n'active qu'environ 3 milliards de paramètres par jeton, tandis que le modèle dense de 9B est livré avec une version "Mobile" quantifiée compressée à environ 1,5 Go pour une utilisation sur appareil.officechai+2
DeepReinforce a été fondée par le Dr Jiwei Li, titulaire d'un doctorat en informatique de Stanford et nommé dans la liste des Innovateurs de moins de 35 ans de la MIT Technology Review. Le laboratoire s'est d'abord fait connaître avec CUDA-L1 et CUDA-L2, des frameworks d'apprentissage par renforcement pour optimiser le code CUDA, avant de lancer Ornith-1.0 le 25 juin 2026. Ce premier lancement était basé sur Qwen 3.5 d'Alibaba Group Holding Limited avec un pré-entraînement et un post-entraînement supplémentaires.kie+1
Ce lancement intervient alors que les laboratoires chinois et liés à la Chine continuent de réduire l'écart avec les modèles de pointe américains en matière de poids ouverts. Qwen d'Alibaba et DeepSeek ont fait des déclarations similaires ces derniers mois, et les modèles à poids ouverts se comparent de plus en plus aux modèles fermés plutôt qu'entre eux uniquement. Toutes les variantes d'Ornith-1.5 sont disponibles sur Hugging Face avec des variantes quantifiées FP8, GGUF, MLX et NVFP4, et peuvent être exécutées via Ollama, LM Studio et AtomicChat.datanorth+1