GPT-5.6 Sol Ultrafast: 14 ganger raskere – men foreløpig bare for et fåtall

GPT-5.6 Sol Ultrafast: 14 ganger raskere – men foreløpig bare for et fåtall

OpenAI viste 13. august frem "Ultrafast", en ny hastighetsmodus for GPT-5.6 Sol bygget på et samarbeid med chipselskapet Cerebras. Navnet i råteksten hadde et par småfeil å rette – det heter GPT-5.6 Sol, ikke "Soul", og partneren heter Cerebras, ikke "Cerebrris".

Tallene stemmer

Kjernepåstanden er korrekt: Ultrafast-modusen kjører opptil 14 ganger raskere enn standard prosessering, og leverer opptil 750 utdata-token per sekund, mot rundt 53 token per sekund i standardmodus. Det er samme modell og samme intelligensnivå – det er kun maskinvaren under panseret som er byttet ut. Cerebras sine wafer-scale-brikker holder hele modellvekten (rundt 44GB) direkte på selve brikken, i stedet for å måtte hente den fra ekstern minne for hver eneste beregning, og det er denne arkitekturforskjellen som gir farten.

Den viktigste presiseringen: dette er ikke "her" ennå for de fleste

Her må vi dempe overskriften litt. Ultrafast er foreløpig kun tilgjengelig som en begrenset forhåndsvisning for en utvalgt gruppe kunder, og kun via OpenAI sitt API – ikke i den vanlige ChatGPT-appen. De fleste utviklere kan altså ikke bare skru dette på ennå; man må melde interesse og vente på at OpenAI utvider tilgangen etter hvert som kapasiteten øker.

Prisen er faktisk ikke annonsert

Råteksten spår at ekstra hastighet "definitivt vil komme med en kostnad" – det er en rimelig antagelse gitt at spesialisert Cerebras-maskinvare koster mer per token enn standard GPU-drift, men det er verdt å presisere at OpenAI foreløpig ikke har publisert noen pris for Ultrafast-tjenesten i det hele tatt. Vi vet altså at det trolig blir dyrere, men ikke hvor mye.

Konteksten: en tungt finansiert satsing

Dette er ikke et engangssamarbeid. Cerebras signerte tidligere i 2026 en avtale med OpenAI verdt over 10 milliarder dollar, med en kapasitetsforpliktelse på 750 megawatt beregningskraft frem til 2028. Ultrafast er det første synlige produktet av den avtalen rettet mot OpenAIs flaggskip-modell, ikke bare mindre spesialmodeller.

Spekulasjonene i råteksten er verdt å ta med som nettopp det

Ideen om at utviklere kan gå fra ti parallelle agenter til et par raske i stedet, og at din egen maskin kan bli flaskehalsen når svarene kommer så fort – dette er rimelige og interessante spekulasjoner om hvordan slik hastighet kan endre hvordan vi designer AI-systemer, men det er nettopp spekulasjoner. Foreløpig er det for tidlig å si hvordan det faktisk vil påvirke arbeidsflyter i praksis, siden så få har fått teste det ennå.

Ressurser

Read more