inferens

Cerebras lanserar ultraläge för OpenAI GPT-5.6 Sol

Cerebras Systems meddelade på torsdagen att de driver en ny "Ultrafast"-tjänstenivå i OpenAI API för GPT-5.6 Sol, som levererar upp till 750 utdata-tokens per sekund — upp till 14 gånger snabbare än standardbearbetning utan förlust av modellintelligens.

AMD köper startup som bygger in AI-modeller direkt i chip

AMD Advanced Micro Devices, Inc. meddelade på torsdagen att de har nått en bindande överenskommelse om att förvärva Toronto-baserade Taalas, en startup som bygger in AI-modellvikter direkt i kisel för att leverera inferenshastigheter långt utöver konventionella GPU:er. De finansiella villkoren…

OpenAI hittar optimering som halverar inferenskostnaderna

OpenAI-ingenjörer utvecklade tidigare denna månad en optimering som minskar inferenskostnaderna med mer än hälften för de modeller den har tillämpats på, enligt en rapport från The Information. Genombrottet, som bygger på att pressa ut mer effektivitet ur befintliga serverresurser istället…