Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1Νέα δεδομένα αξιολόγησης από την πλατφόρμα InferenceX της SemiAnalysis δείχνουν ότι η GPU Instinct MI355X της AMD Advanced Micro Devices, Inc. εκτελεί το μοντέλο Kimi K3 2,8 τρισεκατομμυρίων παραμέτρων της Moonshot AI με χαμηλότερο κόστος ανά token από το B300 της Nvidia , δίνοντας στην AMD νέα επιχειρήματα στον ανταγωνισμό επεξεργαστών τεχνητής νοημοσύνης για κέντρα δεδομένων, μόλις λίγες ημέρες πριν από την ανακοίνωση των οικονομικών της αποτελεσμάτων για το δεύτερο τρίμηνο.
Η πλατφόρμα InferenceX, μια ανεξάρτητη υποδομή αξιολόγησης ανοικτού κώδικα που μετρά συνεχώς την απόδοση συμπερασματικής τεχνητής νοημοσύνης σε διάφορες GPU και λογισμικά, δημοσίευσε αρχικές δοκιμές για το Kimi K3 στις νεότερες GPU των Nvidia και AMD. Σύμφωνα με αναφορές για τα αποτελέσματα, το MI355X εκτελεί το Kimi K3 με λιγότερο από το μισό ωριαίο κόστος ενοικίασης στο υπολογιστικό νέφος σε σύγκριση με το B300. Η διαφορά αυτή οφείλεται σε μεγάλο βαθμό στη σημαντικά χαμηλότερη τιμή ανά ώρα GPU του MI355X στην αγορά. Οι πάροχοι υπηρεσιών νέφους προσφέρουν αυτή τη στιγμή υπολογιστικούς πόρους MI355X ξεκινώντας από περίπου 2,50 δολάρια ανά ώρα GPU, έναντι περίπου 6,00 δολαρίων για το B300.news.ycombinator+4
Το Kimi K3, που κυκλοφόρησε από τη Moonshot AI με έδρα το Πεκίνο στις 16 Ιουλίου, είναι ένα μοντέλο αρχιτεκτονικής Mixture-of-Experts με συνολικά 2,8 τρισεκατομμύρια παραμέτρους και παράθυρο πλαισίου ενός εκατομμυρίου tokens. Το τεράστιο μέγεθός του, που απαιτεί 288 GB μνήμης HBM ανά GPU, σημαίνει ότι δεν μπορεί να χωρέσει στους παλαιότερους κόμβους B200 της Nvidia σε ακρίβεια FP4, περιορίζοντας την εγκατάστασή του σε συστήματα B300, GB300 NVL72 ή MI355X. Αυτός ο υλικότεχνικός περιορισμός δημιουργεί στην πράξη μια αμφίρροπη μάχη σώμα με σώμα ανάμεσα στους νεότερους επιταχυντές 288 GB της AMD και της Nvidia.amd+3
Το αποτέλεσμα του Kimi K3 επιβεβαιώνει μια τάση που ήταν ήδη ορατή στις προγενέστερες συγκρίσεις της InferenceX από τη SemiAnalysis. Στο μικρότερο μοντέλο Kimi K2.6, το B300 προσέφερε 29 τοις εκατό υψηλότερη απόλυτη ταχύτητα επεξεργασίας ανά GPU, αλλά το MI355X ήταν 23 τοις εκατό φθηνότερο ανά token. Παρόμοια εικόνα εμφανίστηκε και στο MiniMax M3, όπου το MI355X ήταν 24 τοις εκατό φθηνότερο ανά token παρά τη χαμηλότερη απόλυτη απόδοση. Ανεξάρτητη αξιολόγηση από τη Signal65 τον Ιούλιο διαπίστωσε ότι το MI355X πέτυχε 1,4 έως 2,1 φορές περισσότερα tokens ανά δολάριο σε σύγκριση με το B200 σε πολλαπλά μοντέλα.signal65+2
Η χρονική στιγμή είναι ιδιαίτερα σημαντική. Η AMD ανακοινώνει τα οικονομικά αποτελέσματα του δεύτερου τριμήνου του 2026 στις 4 Αυγούστου, με τις εκτιμήσεις των αναλυτών να κάνουν λόγο για έσοδα ύψους περίπου 11,2 δισεκατομμυρίων δολαρίων, δηλαδή ετήσια αύξηση 46 τοις εκατό. Ο τομέας των κέντρων δεδομένων, ο οποίος έφτασε τα 5,8 δισεκατομμύρια δολάρια το πρώτο τρίμηνο χάρη στις συνεχείς αποστολές GPU Instinct, βρίσκεται στο επίκεντρο του ενδιαφέροντος των επενδυτών. Η Wedbush αύξησε πρόσφατα την πρόβλεψή της για τα έσοδα του 2026 στα 49,2 δισεκατομμύρια δολάρια, επικαλούμενη ταχύτερη από την αναμενόμενη ανάπτυξη στα κέντρα δεδομένων.seekingalpha+3
Το κεντρικό ερώτημα παραμένει το κατά πόσο οι δοκιμές κόστους συμπερασματικής λειτουργίας θα μετατραπούν σε κέρδη μεριδίου αγοράς. Το B300 της Nvidia εξακολουθεί να υπερέχει στην απόλυτη απόδοση, ενώ το οικοσύστημα λογισμικού CUDA διατηρεί ισχυρή εδραίωση στον εταιρικό τομέα. Ωστόσο, καθώς μοντέλα ανοικτών βαρών όπως το Kimi K3 πιέζουν τις απαιτήσεις υλικού στα όριά τους, το τιμολογιακό πλεονέκτημα της AMD προσφέρει στους παρόχους νέφους και μεγάλων υποδομών μια δελεαστική εναλλακτική πρόταση.