Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

startupfortune+1x+1finance.yahoo+1SemiAnalysis-ի InferenceX հարթակի նոր թեստային տվյալները ցույց են տալիս, որ AMD-ի (Advanced Micro Devices, Inc.) Instinct MI355X GPU-ն աշխատեցնում է Moonshot AI-ի 2.8 տրիլիոն պարամետր ունեցող Kimi K3 մոդելը մեկ թոքենի հաշվարկով ավելի ցածր ինքնարժեքով, քան Nvidia-ի B300-ը: Սա AMD-ին լրացուցիչ առավելություն է տալիս տվյալների կենտրոնների արհեստական բանականության չիպերի մրցավազքում երկրորդ եռամսյակի ֆինանսական հաշվետվության հրապարակումից ընդամենը օրեր առաջ:
InferenceX հարթակը, որը բաց կոդով անկախ թեստավորման համակարգ է և անընդհատ չափում է AI-ի ինֆերենսի արտադրողականությունը տարբեր GPU-ների ու ծրագրային փաթեթների վրա, հրապարակել է Kimi K3-ի առաջին օրվա թեստավորման արդյունքները Nvidia-ի և AMD-ի ամենանոր GPU-ների համար: Արդյունքների վերաբերյալ զեկույցի համաձայն: MI355X-ը աշխատեցնում է Kimi K3-ը B300-ի ամպային վարձակալության ժամային արժեքից ավելի քան կրկնակի էժան գնով, ինչը մեծապես պայմանավորված է շուկայում MI355X-ի մեկ GPU-ժամի զգալիորեն ցածր գնով: Ամպային ծառայություններ մատուցողներն այժմ MI355X-ի սերվերային միավորները առաջարկում են սկսած մոտ 2.50 դոլարից մեկ GPU-ժամի համար: B300-ի մոտ 6.00 դոլարի համեմատ:news.ycombinator+4
Kimi K3-ը, որը թողարկվել է Պեկինում տեղակայված Moonshot AI ընկերության կողմից հուլիսի 16-ին, Mixture-of-Experts ճարտարապետությամբ մոդել է, որն ունի ընդհանուր առմամբ 2.8 տրիլիոն պարամետր և մեկ միլիոն թոքենանոց կոնտեքստային պատուհան: Դրա հսկայական չափերը, որոնք պահանջում են 288 ԳԲ HBM հիշողություն յուրաքանչյուր GPU-ի համար, նշանակում են, որ այն չի կարող տեղավորվել Nvidia-ի ավելի հին B200 հանգույցներում FP4 ճշտությամբ: Սա սահմանափակում է տեղակայումը միայն B300, GB300 NVL72 կամ MI355X համակարգերով: Այդ ապարատային սահմանափակումը փաստացի ստեղծում է ուղիղ մրցակցություն AMD-ի և Nvidia-ի վերջին 288 ԳԲ արագացուցիչների միջև:amd+3
Kimi K3-ի արդյունքը շարունակում է այն միտումը, որը նկատելի էր SemiAnalysis-ի նախորդ InferenceX համեմատություններում: Ավելի փոքր Kimi K2.6 մոդելի վրա B300-ն ապահովել է 29 տոկոսով ավելի բարձր թողունակություն մեկ GPU-ի հաշվով, սակայն MI355X-ը 23 տոկոսով ավելի էժան է եղել մեկ թոքենի հաշվարկով: Նմանատիպ դինամիկա է արձանագրվել նաև MiniMax M3 մոդելի դեպքում, որտեղ MI355X-ը 24 տոկոսով ավելի էժան էր մեկ թոքենի համար, չնայած ավելի ցածր բացարձակ թողունակությանը: Signal65-ի կողմից հուլիսին անցկացված անկախ գնահատումը ցույց է տվել, որ MI355X-ը մի շարք մոդելներում ապահովել է 1.4-ից 2.1 անգամ ավելի շատ թոքեն մեկ դոլարի դիմաց, քան B200-ը:signal65+2
Ժամկետն հատկանշական է: AMD-ն 2026 թվականի 2-րդ եռամսյակի ֆինանսական արդյունքները կներկայացնի օգոստոսի 4-ին: Վերլուծաբանների կանխատեսումներով հասույթը կկազմի մոտ 11.2 միլիարդ դոլար, ինչը ներկայացնում է 46 տոկոս աճ տարեկան կտրվածքով: Տվյալների կենտրոնների սեգմենտը, որն առաջին եռամսյակում հասել էր 5.8 միլիարդ դոլարի Instinct GPU-ների շարունակական մատակարարումների շնորհիվ, ներդրողների ուշադրության կենտրոնում է: Wedbush-ը վերջերս բարձրացրել է 2026 թվականի հասույթի իր կանխատեսումը մինչև 49.2 միլիարդ դոլար: նշելով տվյալների կենտրոնների սպասվածից ավելի արագ աճը:seekingalpha+3
Արդյոք ինֆերենսի ծախսերի համեմատական թեստերը կվերածվեն շուկայի մասնաբաժնի աճի, մնում է գլխավոր հարցը: Nvidia-ի B300-ը դեռ առաջատար է բացարձակ թողունակությամբ, իսկ դրա CUDA ծրագրային էկոհամակարգը ամուր դիրքեր ունի խոշոր ընկերություններում: Սակայն, քանի որ Kimi K3-ի նման բաց կոդով (open-weight) մոդելները հասցնում են ապարատային պահանջները իրենց սահմանագծին, AMD-ի գնային առավելությունը հիպերսքեյլերներին և ամպային ծառայություններ մատուցողներին առաջարկում է համոզիչ այլընտրանքային հաշվարկ: