inferens

Cerebras lanserer ultrarask modus for OpenAI GPT-5.6 Sol

Cerebras Systems kunngjorde torsdag at de driver et nytt "Ultrafast"-tjenestenivå i OpenAI API for GPT-5.6 Sol, som leverer opptil 750 utdata-tokens per sekund — opptil 14 ganger raskere enn standard prosessering uten tap av modellintelligens.

AMD kjøper opp oppstartsselskap som bygger AI-modeller rett inn i brikker

AMD Advanced Micro Devices, Inc. kunngjorde torsdag at de har inngått en bindende avtale om å kjøpe Toronto-baserte Taalas, en oppstart som bygger AI-modellvekter direkte inn i silisium for å levere inferenshastigheter langt utover konvensjonelle GPU-er. De økonomiske vilkårene er…

OpenAI finner optimalisering som halverer inferenskostnadene

OpenAI-ingeniører utviklet tidligere denne måneden en optimalisering som reduserer inferenskostnadene med mer enn halvparten for modellene den har blitt brukt på, ifølge en rapport fra The Information. Gjennombruddet, som stammer fra å presse mer effektivitet ut av eksisterende serverressurser i…