Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

news.futunn+1officechai+1memeburn+1Το μοντέλο Qwen3.8-Max της Alibaba κατέλαβε την πρώτη θέση στον δείκτη Agentic Index της Artificial Analysis με βαθμολογία 55,4, ξεπερνώντας οριακά το Claude Opus 5 της Anthropic με 55,3 μονάδες και το GPT 5.6 της OpenAI, σύμφωνα με την τελευταία κατάταξη του οργανισμού αξιολόγησης που δημοσιεύθηκε αυτή την εβδομάδα. Το αποτέλεσμα σηματοδοτεί την πρώτη φορά που ένα κινεζικό μοντέλο τεχνητής νοημοσύνης καταλαμβάνει την κορυφή στον πίνακα κατάταξης ικανοτήτων πρακτόρων, ο οποίος μετρά την ικανότητα ενός μοντέλου να επιλύει αυτόνομα σύνθετα προβλήματα πολλαπλών σταδίων.news.futunn+1
Οι μετοχές της Alibaba στο χρηματιστήριο του Χονγκ Κονγκ σημείωσαν άνοδο περίπου 7% μετά τις ισχυρές επιδόσεις του μοντέλου σε πολλαπλούς πίνακες κατάταξης.memeburn
Το μοντέλο 2,4 τρισεκατομμυρίων παραμέτρων, που παρουσιάστηκε στις 3 Αυγούστου, χρησιμοποιεί μια αρχιτεκτονική μείγματος ειδικών (mixture-of-experts) που ενεργοποιεί περίπου 95 δισεκατομμύρια παραμέτρους ανά πέρασμα. Επίσης, συγκέντρωσε 56 μονάδες στον ευρύτερο δείκτη Artificial Analysis Intelligence Index, τοποθετώντας το στο ίδιο επίπεδο με το Claude Opus 4.8 και μπροστά από μοντέλα της Google Alphabet Inc. , της Meta και της xAI.officechai+2
Μεγάλο μέρος των κερδών του Qwen3.8-Max στην πρακτορική ικανότητα προέρχεται από μια αλλαγή στον τρόπο προσέγγισης των εργασιών. Το μοντέλο πραγματοποιεί κατά μέσο όρο 64 βήματα στην αξιολόγηση GDPval-AA, σε σύγκριση με τα 14 του προκατόχου του Qwen3.7 Max, με τη χρήση διακριτικών εισόδου (input tokens) να αυξάνεται περίπου 15 φορές. Αυτός ο επιπλέον υπολογιστικός φόρτος οδηγεί σε υψηλότερες βαθμολογίες, αλλά αυξάνει επίσης το κόστος ανά εργασία στα 1,14 δολάρια, υπερδιπλάσιο από τα 0,53 δολάρια του Qwen3.7 Max.officechai
Η Alibaba δήλωσε ότι θα διαθέσει τα βάρη του μοντέλου την επόμενη εβδομάδα, γεγονός που θα καταστήσει το Qwen3.8-Max το μεγαλύτερο μοντέλο ανοιχτών βαρών που είναι διαθέσιμο, όντας περίπου έξι φορές μεγαλύτερο από την προηγούμενη μεγαλύτερη ανοιχτή κυκλοφορία της Alibaba. Η τιμολόγηση API ανά διακριτικό έχει οριστεί στα 2,00 δολάρια ανά εκατομμύριο διακριτικά εισόδου και 6,00 δολάρια ανά εκατομμύριο διακριτικά εξόδου, τιμή φθηνότερη από τον προκάτοχό του.venturebeat+1
Η κυκλοφορία εντείνει μια τάση κατά την οποία τα κινεζικά εργαστήρια κλείνουν την ψαλίδα με τους πρωτοπόρους προγραμματιστές των ΗΠΑ. Το μοντέλο Kimi K3 της Moonshot AI, με 2,8 τρισεκατομμύρια παραμέτρους, εξακολουθεί να προηγείται των κινεζικών μοντέλων στον δείκτη Intelligence Index με βαθμολογία 57, αλλά το Qwen3.8-Max βρίσκεται πλέον μόλις μία μονάδα πίσω. Το VentureBeat σημείωσε ότι το μοντέλο υπερέχει επίσης των GPT-5.6 Sol Max και Fable 5 στο OSWorld-Verified, ένα σημείο αναφοράς για τη χρήση επιτραπέζιων υπολογιστών.officechai+1
Τα κέρδη δεν είναι ομοιόμορφα. Το ποσοστό παραισθήσεων του Qwen3.8-Max αυξήθηκε από 23% σε 40% στην αξιολόγηση AA-Omniscience, πράγμα που σημαίνει ότι πλέον επιχειρεί να απαντήσει σε ερωτήσεις που προηγουμένως απέρριπτε, κάνοντας πολλά λάθη. Η Anthropic και η OpenAI διατηρούν το προβάδισμα στην κορυφή του συνολικού δείκτη Intelligence Index, ενώ το κόστος ανά εργασία για πρακτορική εργασία παραμένει υψηλότερο από αρκετούς ανταγωνιστές στην ίδια κατηγορία απόδοσης.officechai