Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

officechai+1officechaikursivΗ Alibaba κυκλοφόρησε το Qwen3.8-27B, ένα πυκνό πολυτροπικό μοντέλο 27 δισεκατομμυρίων παραμέτρων με άδεια Apache 2.0, υλοποιώντας τη δέσμευση που είχε αναλάβει κατά την παρουσίαση της οικογένειας μοντέλων στις 3 Αυγούστου για τη διάθεση του κώδικα τόσο των μικρών όσο και των κορυφαίων μοντέλων της.officechai+1
Η κυκλοφορία, η οποία έγινε διαθέσιμη στο Hugging Face στις 14 Αυγούστου, διαθέτει εγγενές παράθυρο πλαισίου 262.000 tokens, το οποίο μπορεί να επεκταθεί στο 1 εκατομμύριο μέσω του YaRN, και έχει σχεδιαστεί για να εκτελείται σε μια απλή κάρτα γραφικών καταναλωτικού επιπέδου με κβαντισμό 4-bit. Παράλληλα, η Alibaba άνοιξε τα βάρη για το Qwen3.8-2.4T-A95B, την έκδοση Max τύπου mixture-of-experts με 2,4 τρισεκατομμύρια συνολικές παραμέτρους και περίπου 95 δισεκατομμύρια ενεργές παραμέτρους ανά token.yottalabs+3
Η σύγκριση που προκαλεί το μεγαλύτερο ενδιαφέρον είναι με το Muse Glimmer-30B της Meta , ένα τοπικό μοντέλο που κυκλοφόρησε η Meta λίγες ημέρες νωρίτερα. Στο Terminal Bench 2.1, το οποίο μετρά τον προγραμματισμό μέσω τερματικού, το Qwen3.8-27B συγκεντρώνει 73,0 βαθμούς έναντι 51,7 του Muse Glimmer. Στο GPQA Diamond, ένα σημείο αναφοράς για επιστημονική συλλογιστική, σημειώνει 89,2 έναντι 83,5. Σε κάθε τεστ όπου δοκιμάστηκαν και τα δύο μοντέλα, το Qwen3.8-27B προηγείται.officechai
Πιο αξιοσημείωτη είναι η απόδοση του μοντέλου 27B έναντι πολύ μεγαλύτερων συστημάτων. Σε σύγκριση με το Qwen3.7-Plus της ίδιας της Alibaba, ένα μεγαλύτερο ιδιοταγές μοντέλο, το Qwen3.8-27B κερδίζει στα περισσότερα σημεία αναφοράς, σημειώνοντας 61,7 στο SWE-bench Pro έναντι 57,6 και 79,0 στο QwenSWEBench έναντι 59,2. Έναντι του Opus4.6 Max της Anthropic, το μικρότερο μοντέλο υστερεί σε πιο δύσκολες εργασίες συλλογιστικής, αλλά το κερδίζει στο SWE-bench Pro (61,7 έναντι 53,4) και στην ακολουθία οδηγιών στο IFBench (79,5 έναντι 62,5).officechai
Η ισχυρότερη κατηγορία του μοντέλου είναι η υποστήριξη εργασιών γραφείου. Στο CoWorkBench, το σημείο αναφοράς της Alibaba για εργασίες παραγωγικότητας μεγάλης διάρκειας, συγκεντρώνει 70,7, ξεπερνώντας το 68,2 του Opus4.6 Max.officechai
Η διπλή κυκλοφορία έρχεται σε μια στιγμή που τα κινεζικά μοντέλα τεχνητής νοημοσύνης κερδίζουν έδαφος παγκοσμίως. Οι ρωσικές επιχειρήσεις κατανάλωσαν 400 δισεκατομμύρια tokens κινεζικών LLM το πρώτο εξάμηνο του 2026, σημειώνοντας αύξηση 11 φορές σε σχέση με ολόκληρο το 2025, με το Qwen να αντιπροσωπεύει από μόνο του 261 δισεκατομμύρια tokens, σύμφωνα με τον ρωσικό πάροχο cloud MWS Cloud. Η στρατηγική ανοιχτών βαρών υπό την άδεια Apache 2.0 επιτρέπει στην Alibaba να προσελκύσει προγραμματιστές και στις δύο πλευρές της αγοράς, από ερασιτέχνες που εκτελούν κβαντισμένα μοντέλα τοπικά έως ομάδες που αναπτύσσουν το πλήρες μοντέλο επιπέδου Max για υποδομές παραγωγής.kursiv+2