Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

officechai+1saascity+1officechai+1DeepReinforce julkaisi 19. elokuuta 2026 Ornith-1.5-malliperheen, joka koostuu kolmesta eri kokoluokasta (397B, 35B ja 9B parametria). Yhtiön mukaan mallit vastaavat tai ylittävät Anthropicin Claude Opus 4.8 -mallin suorituskyvyn useissa koodaus- ja päättelytesteissä. Mallit on julkaistu MIT-lisenssillä Hugging Facessa, mikä mahdollistaa rajoittamattoman kaupallisen käytön.officechai+1
Lippulaivamalli Ornith-1.5-397B, joka hyödyntää asiantuntijoiden sekoitusarkkitehtuuria (MoE), saavutti 86,1 pistettä Terminal-Bench 2.1 -testissä ja 86 pistettä SWE-Bench Verified -testissä. DeepReinforcen julkaisemien tulosten mukaan Claude Opus 4.8 sai vastaavissa testeissä 85 ja 85,8 pistettä. Vaativammassa DeepSWE-koodaustestissä malli sai 56 pistettä, mikä on merkittävä parannus aiemman Ornith-1.0-version 8 pisteestä, vaikka se jääkin yhä Claude Opus 4.8:n 59 pisteen alapuolelle. Frontier-Bench v0.1 -testissä malli jäi selvemmin jälkeen 13,5 pisteellä Claude Opus 4.8:n 21,1 pisteeseen verrattuna.saascity+2
Arkkitehtuuri laajentaa Ornith-1.0:n "itsetelineistys"-konseptia siihen, mitä DeepReinforce kutsuu täydelliseksi itsekehittyväksi silmukaksi: malli ehdottaa omia koulutustehtäviään, kirjoittaa tehtäväkohtaisia rakenteita ja tuottaa vahvistusoppimisen tuloksia, jotka syötetään takaisin koulutusprosessiin. 35B MoE -versio aktivoi vain noin 3 miljardia parametria per token, kun taas 9B-tiheysmallista on saatavilla kvantisoitu "Mobile"-versio, joka on pakattu noin 1,5 gigatavuun mobiilikäyttöä varten.officechai+2
DeepReinforcen perusti tohtori Jiwei Li, Stanfordin yliopistosta valmistunut tietojenkäsittelytieteen tohtori, joka on valittu MIT Technology Review'n Innovators Under 35 -listalle. Laboratorio tuli tunnetuksi CUDA-L1- ja CUDA-L2-vahvistusoppimiskehyksillään, jotka optimoivat CUDA-koodia, ennen kuin se julkaisi Ornith-1.0-mallin 25. kesäkuuta 2026. Ensimmäinen julkaisu perustui Alibaba Group Holding Limitedin Qwen 3.5 -malliin, johon oli lisätty esikoulutusta ja jatkokoulutusta.kie+1
Julkaisu tapahtuu aikana, jolloin kiinalaiset ja kiinalaistaustaiset laboratoriot kurovat umpeen eroa yhdysvaltalaisiin huippumalleihin avoimen painoarvon saralla. Alibaban Qwen ja DeepSeek ovat esittäneet vastaavia väitteitä viime kuukausina, ja avoimen painoarvon mallit vertaavat itseään yhä useammin suljettuihin malleihin pelkän keskinäisen vertailun sijaan. Kaikki Ornith-1.5-versiot ovat saatavilla Hugging Facessa FP8-, GGUF-, MLX- ja NVFP4-kvantisoiduissa muodoissa, ja niitä voi ajaa Ollaman, LM Studion ja AtomicChatin kautta.datanorth+1