Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunch+1stable-learncryptobriefingΤο μυστήριο που απασχολούσε τους προγραμματιστές τεχνητής νοημοσύνης για σχεδόν μια εβδομάδα λύθηκε. Η Z.ai, η κινεζική εταιρεία τεχνητής νοημοσύνης που ήταν παλαιότερα γνωστή ως Zhipu AI, επιβεβαίωσε την Τετάρτη ότι το ανώνυμο μοντέλο "Ox Alpha" που εμφανίστηκε στο OpenRouter και το OpenCode είναι το GLM-5.3-Flash, το πρώτο εγγενώς πολυτροπικό μοντέλο της σειράς GLM-5.africa.businessinsider+1
Το μοντέλο, το οποίο προσφερόταν δωρεάν και χωρίς αναφορά προέλευσης από τις 20 Αυγούστου, τράβηξε την προσοχή προγραμματιστών και ηγετών της τεχνολογίας. Ο διευθύνων σύμβουλος της Stripe, Patrick Collison, το χαρακτήρισε "πολύ εντυπωσιακό" στο X. Πριν από την αποκάλυψη, το Ox Alpha είχε συγκεντρώσει πάνω από 503.000 μοναδικούς χρήστες και είχε επεξεργαστεί 44 τρισεκατομμύρια tokens μόνο στο OpenCode.techcrunch+1
Το GLM-5.3-Flash χρησιμοποιεί μια αρχιτεκτονική μείγματος ειδικών (mixture-of-experts) με συνολικά 320 δισεκατομμύρια παραμέτρους, αλλά ενεργοποιεί μόνο 18 δισεκατομμύρια ανά token, μειώνοντας δραματικά το υπολογιστικό κόστος σε σύγκριση με πυκνά μοντέλα παρόμοιων δυνατοτήτων. Το μοντέλο υποστηρίζει παράθυρο πλαισίου ενός εκατομμυρίου tokens και δέχεται εγγενώς εισόδους κειμένου, εικόνας και βίντεο.cryptobriefing+1
Στο benchmark κώδικα DeepSWE v1.1, το GLM-5.3-Flash σημείωσε 63,4 βαθμούς, έναντι 46,2 του προκατόχου του GLM-5.2. Η Z.ai υποστηρίζει ότι πλησιάζει το Claude Opus 4.8 στο εσωτερικό της benchmark κώδικα, σημειώνοντας 29,0 έναντι 29,5 του Opus 4.8. Η τιμολόγηση του API ανέρχεται σε 0,15 δολάρια ανά εκατομμύριο tokens εισόδου και 0,50 δολάρια ανά εκατομμύριο tokens εξόδου, δηλαδή περίπου το ένα δέκατο του κόστους συγκρίσιμων ιδιοταγών εναλλακτικών λύσεων.officechai+1
Τα βάρη είναι διαθέσιμα υπό την άδεια MIT στο Hugging Face και το ModelScope, επιτρέποντας την απεριόριστη εμπορική χρήση.testingcatalog+1
Ίσως η πιο σημαντική πτυχή της κυκλοφορίας είναι η υποδομή πίσω από αυτήν. Η Z.ai αναφέρει ότι το GLM-5.3-Flash εκτελείται εξ ολοκλήρου σε εγχώρια κατασκευασμένους επιταχυντές τεχνητής νοημοσύνης, με μια προσαρμοσμένη στοίβα εξυπηρέτησης βασισμένη στο SGLang που απέδωσε τριπλάσια βελτίωση στην απόδοση από άκρο σε άκρο. Η εταιρεία παρουσίασε αυτό το γεγονός ως απόδειξη ότι τα κινεζικά τσιπ μπορούν να υποστηρίξουν την εξαγωγή συμπερασμάτων από μοντέλα αιχμής με ανταγωνιστικό κόστος, ένας ισχυρισμός που έχει βαρύτητα εν μέσω των συνεχιζόμενων αμερικανικών ελέγχων εξαγωγών που περιορίζουν την πρόσβαση στους πιο προηγμένους επεξεργαστές της Nvidia .testingcatalog+1
Η Z.ai είχε εκπαιδεύσει προηγουμένως το βασικό της μοντέλο GLM-5 σε τσιπ Huawei Ascend, αλλά το GLM-5.3-Flash επεκτείνει αυτή την ανεξαρτησία στο επίπεδο συμπερασμάτων σε κλίμακα.siliconrepublic
Η ανώνυμη κυκλοφορία ακολούθησε ένα μοτίβο που η Z.ai έχει χρησιμοποιήσει ξανά, καθώς είχε δοκιμάσει ένα παλαιότερο μοντέλο με το όνομα "Pony Alpha" στο OpenRouter. Αυτή τη φορά, το εγχείρημα συγκέντρωσε πολύ μεγαλύτερη προσοχή, με τους προγραμματιστές να αναλύουν τα αποτυπώματα των tokenizers και τους κωδικούς σφαλμάτων API για να εντοπίσουν τον κατασκευαστή πριν από την επίσημη ανακοίνωση.kingy+2
Όπως σημείωσε το TechCrunch, η κυκλοφορία "προστίθεται στην αυξανόμενη απειλή φθηνών, ικανών μοντέλων από την Κίνα που θα μπορούσαν να αποσπάσουν πραγματικό μερίδιο αγοράς από ακριβές εταιρείες μοντέλων αιχμής όπως η OpenAI και η Anthropic".techcrunch