Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1Nuevos datos de rendimiento de la plataforma InferenceX de SemiAnalysis muestran que la GPU Instinct MI355X de Advanced Micro Devices, Inc. ejecuta el modelo Kimi K3 de Moonshot AI, de 2,8 billones de parámetros, a un coste por token menor que la B300 de Nvidia . Esto proporciona a AMD nuevos argumentos en la carrera de chips de IA para centros de datos justo unos días antes de su informe de resultados del segundo trimestre.
La plataforma InferenceX, una prueba de rendimiento de código abierto e independiente de proveedores que mide continuamente el rendimiento de la inferencia de IA en GPUs y entornos de software, publicó pruebas iniciales para Kimi K3 en las GPU más recientes de Nvidia y AMD. Según la información sobre los resultados, la MI355X ejecuta Kimi K3 a menos de la mitad del coste de alquiler por hora en la nube que la B300, una diferencia impulsada en gran medida por el precio por hora de GPU sustancialmente más bajo de la MI355X en el mercado. Los proveedores de la nube listan actualmente instancias de MI355X desde aproximadamente 2,50 dólares por hora de GPU, en comparación con los cerca de 6,00 dólares de la B300.news.ycombinator+4
Kimi K3, lanzado el 16 de julio por la empresa pequinesa Moonshot AI, es un modelo de mezcla de expertos (Mixture-of-Experts) con 2,8 billones de parámetros totales y una ventana de contexto de un millón de tokens. Su enorme tamaño, que requiere 288 GB de HBM por GPU, impide que quepa en los nodos B200 más antiguos de Nvidia con precisión FP4, lo que limita su despliegue a sistemas B300, GB300 NVL72 o MI355X. Esa restricción de hardware crea de forma efectiva una comparación directa entre los últimos aceleradores de 288 GB de AMD y Nvidia.amd+3
El resultado de Kimi K3 amplía un patrón observable en las comparaciones anteriores de InferenceX de SemiAnalysis. Con el modelo más pequeño Kimi K2.6, la B300 ofreció un 29 por ciento más de rendimiento bruto por GPU, pero la MI355X resultó un 23 por ciento más barata por token. Una dinámica similar se mantuvo en MiniMax M3, donde la MI355X fue un 24 por ciento más barata por token a pesar de tener un menor rendimiento absoluto. Una evaluación independiente realizada por Signal65 en julio reveló que la MI355X logró entre 1,4 y 2,1 veces más tokens por dólar que la B200 en múltiples modelos.signal65+2
El momento elegido es relevante. AMD presenta sus resultados del segundo trimestre de 2026 el 4 de agosto, con unas expectativas de consenso de aproximadamente 11.200 millones de dólares en ingresos, lo que representa un crecimiento del 46 por ciento interanual. El segmento de centros de datos, que alcanzó los 5.800 millones de dólares en el primer trimestre gracias a los constantes envíos de GPU Instinct, es el punto focal para los inversores. Wedbush elevó recientemente su estimación de ingresos para 2026 a 49.200 millones de dólares, citando un crecimiento en centros de datos más rápido de lo esperado.seekingalpha+3
La cuestión central sigue siendo si los datos comparativos de costes de inferencia se traducirán en ganancia de cuota de mercado. La B300 de Nvidia sigue liderando en rendimiento bruto y su ecosistema de software CUDA mantiene un profundo arraigo empresarial. Sin embargo, a medida que los modelos de código abierto como Kimi K3 llevan las exigencias de hardware al límite, la ventaja de precio de AMD ofrece a los proveedores de servicios en la nube una alternativa convincente.