Grok 4.6: Sterk på kunnskapsarbeid, ikke best overalt
SpaceXAI (tidligere xAI) slapp Grok 4.6 12. august 2026, bygget videre på samme 1,5 billioner parameter-fundament som Grok 4.5, men med et lengre etterfølgende trenings- og finjusteringssteg. Fem uker etter forgjengeren er fremgangen betydelig – men bildet er mer nyansert enn "ledende aktør" antyder.
GDPval: her stemte faktisk påstanden
Råtekstens referanse til "GDP val" er faktisk GDPval-AA v2, en ekte benchmark fra Artificial Analysis som måler AI-modellers ytelse på reelle økonomiske arbeidsoppgaver på tvers av bransjer som ingeniørfag, finans, AutoCAD og videoredigering. Her scoret Grok 4.6 faktisk høyest av modellene xAI selv la fram i sin lanseringstabell – en Elo-score på 1753, foran både GPT-5.6 Sol og Claude Fable 5.
Men her er den viktige presiseringen: xAI sin egen tabell utelot Claude Opus 5, som ifølge uavhengig testing fra Artificial Analysis faktisk ligger foran Grok 4.6 på nøyaktig denne benchmarken. Så "best i verden på GDPval" holder ikke – det er "best blant modellene xAI valgte å vise fram".
Samlet sett: en tredjeplass, ikke en ledertrøye
På Artificial Analysis' samlede intelligensindeks – som veier ni ulike benchmarker sammen – lander Grok 4.6 på 61 poeng. Det er nøyaktig likt med GPT-5.6 Sol, men ett poeng bak Claude Fable 5 (62) og hele to poeng bak Claude Opus 5 (63), som topper listen. Så "konkurrere med de aller beste" stemmer, men "overgått tidligere markedsledere" er en overdrivelse på samlet nivå.
Bildet blir mer detaljert når man ser på enkeltbenchmarker: Grok 4.6 vinner på kunnskapsarbeid (GDPval-AA, AA-Briefcase, juridisk resonnering via Harvey LAB), men taper tydelig på ren programmering – både DeepSWE og Terminal-Bench ligger den bak GPT-5.6 Sol og Fable 5 Max, i noen tilfeller med syv til åtte prosentpoeng.
Der Grok 4.6 faktisk skiller seg ut: prisen
Det mest underrapporterte poenget i lanseringen er kanskje kostnadseffektivitet, ikke rå intelligens. Grok 4.6 koster 2 dollar per million inndata-tokens og 6 dollar per million utdata-tokens – rundt 60 prosent billigere enn både Claude Opus 5 (5/25 dollar) og GPT-5.6 Sol (5/30 dollar), samtidig som den holder tritt med dem på flere av de viktigste kunnskapsoppgavene. Det plasserer Grok 4.6 nær det man kaller "Pareto-fronten" for pris kontra intelligens – ikke den smarteste, men blant de mest kostnadseffektive på det nivået.
Ressurser
- Grok 4.6 – offisiell lansering fra SpaceXAI – benchmarktabell og prising
- Grok 4.6 kritisk gjennomgang av benchmarkene – hva som mangler i xAIs egen tabell