Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1SemiAnalysis'in InferenceX platformundan alınan yeni test verileri, AMD'nin Advanced Micro Devices, Inc. Instinct MI355X GPU'sunun Moonshot AI'ın 2,8 trilyon parametreli Kimi K3 modelini Nvidia'nın B300 çipine kıyasla jeton başına daha düşük maliyetle çalıştırdığını gösteriyor. Bu durum, ikinci çeyrek kazanç raporundan sadece birkaç gün önce veri merkezi yapay zeka çipi yarışında AMD'ye yeni bir koz veriyor.
GPU'lar ve yazılım yığınları genelinde yapay zeka çıkarım performansını sürekli olarak ölçen açık kaynaklı ve tarafsız bir test platformu olan InferenceX, Kimi K3 için en son Nvidia ve AMD GPU'larındaki ilk gün test sonuçlarını yayınladı. Sonuçlara ilişkin raporlara göre MI355X, Kimi K3 modelini B300'ün saatlik bulut kiralama maliyetinin yarısından daha azına çalıştırıyor. Bu fark, büyük ölçüde MI355X'in pazardaki GPU saat başına önemli ölçüde daha düşük fiyatlandırılmasından kaynaklanıyor. Bulut sağlayıcıları şu anda MI355X örneklerini B300 için yaklaşık 6,00 dolar olan fiyata kıyasla GPU saati başına yaklaşık 2,50 dolardan başlayan fiyatlarla listeliyor.news.ycombinator+4
Pekin merkezli Moonshot AI tarafından 16 Temmuz'da yayınlanan Kimi K3, toplam 2,8 trilyon parametreye ve bir milyon jetonluk bağlam penceresine sahip bir Uzman Karışımı (Mixture-of-Experts) modelidir. Modelin devasa boyutu, yani GPU başına 288 GB HBM gerektirmesi, FP4 hassasiyetinde Nvidia'nın eski B200 düğümlerine sığamayacağı anlamına geliyor. Bu durum, modelin kullanımını B300, GB300 NVL72 veya MI355X sistemleriyle sınırlandırıyor. Donanımdaki bu kısıtlama, AMD ile Nvidia'nın en son 288 GB hızlandırıcıları arasında doğrudan bir karşılaştırma yaratıyor.amd+3
Kimi K3 sonucu, SemiAnalysis'in önceki InferenceX karşılaştırmalarında görülen bir eğilimi sürdürüyor. Daha küçük Kimi K2.6 modelinde B300, GPU başına yüzde 29 daha fazla ham işlem hacmi sağladı, ancak MI355X jeton başına yüzde 23 daha ucuzdu. Benzer bir dinamik MiniMax M3 modelinde de geçerliydi, burada MI355X daha düşük mutlak işlem hacmine rağmen jeton başına yüzde 24 daha ucuzdu. Temmuz ayında Signal65 tarafından yapılan bağımsız bir değerlendirme, MI355X'in birden fazla modelde B200'e kıyasla dolar başına 1,4 ila 2,1 kat daha fazla jeton ürettiğini ortaya koydu.signal65+2
Zamanlama oldukça dikkat çekici. AMD, 4 Ağustos'ta 2026 ikinci çeyrek finansal sonuçlarını açıklayacak. Piyasa konsensüsü, yıllık yüzde 46 artışla yaklaşık 11,2 milyar dolar gelir elde edileceği yönünde. Devam eden Instinct GPU sevkiyatlarıyla ilk çeyrekte 5,8 milyar dolara ulaşan veri merkezi segmenti, yatırımcıların odağında yer alıyor. Wedbush kısa süre önce, beklenenden daha hızlı veri merkezi büyümesini gerekçe göstererek 2026 gelir tahminini 49,2 milyar dolara yükseltti.seekingalpha+3
Çıkarım maliyeti testlerinin pazar payı kazanımlarına dönüşüp dönüşmeyeceği temel soru işareti olmaya devam ediyor. Nvidia'nın B300'ü ham işlem hacminde hala lider konumda ve CUDA yazılım ekosistemi kurumlar arasında derin bir yerleşime sahip. Ancak Kimi K3 gibi açık ağırlıklı modeller donanım gereksinimlerinin sınırlarını zorladıkça, AMD'nin fiyat avantajı hiper ölçekleyiciler ve bulut sağlayıcıları için ikna edici bir alternatif sunuyor.