SpaceXAI udgav Grok 4.7, og uafhængige målinger placerer den som nummer fire blandt de største AI-laboratorier.
Artificial Analysis, der er et uafhængigt benchmark-firma, gav modellen 46 point på sin Intelligence Index, hvilket er 2 point højere end Grok 4.6. Claude Fable 5.1, GPT-6 Astra og Claude Opus 5 ligger dog stadig over.
Grok 4.7 bringer SpaceXAI i top fire blandt AI-labs
Elon Musk udtalte før lanceringen, at modellen ville køre på en base på 2,1 billioner parametre og overgå alle nuværende modeller. Han tilføjede, at træningen af modellen inkluderede data fra SpaceX.
Følg os på X for at få de seneste nyheder i realtid
Men hvordan klarer Grok 4.7 sig egentlig? På AA-Briefcase, en Artificial Analysis-måling for realistiske arbejdsopgaver, fik Grok 4.7 en Elo-score på 1657. Det er en stigning på 111 point over Grok 4.6 og bringer modellens niveau tæt på Claude Opus 5.
På GDPval-AA nåede modellen op på 1695 Elo, hvilket er 90 point højere end forgængeren. Resultaterne på kodning bevægede sig i samme retning.
Sammen med Grok Build, dens egen kode-agent, scorede Grok 4.7 56 på Coding Agent Index. Det er ni point højere end Grok 4.6.
Modellen overgik nu GPT-5.6 Sol og ligger kun bag Anthropic’s Claude Fable 5.1, GPT-6 Astra og Opus 5.
“Grok 4.7 scorer 46 på Artificial Analysis Intelligence Index og placerer SpaceXAI blandt de fire største AI-labs. Også præstationen på Coding Agent Index er forbedret og overhaler nu GPT-5.6 Sol,” lød det i opslaget.
Andre steder var fremgangen minimal. Den steg 4,5 procentpoint på Terminal-Bench 4.0 og 3 point på GDP.pdf. Resultaterne faldt på AA-LCR og AutomationBench-AA-målingen. Grok 4.5 toppede AutomationBench i juli, hvilket støttede Musks påstand om, at den kunne matche Claude Opus.
Fremgangen har en pris i tokens
Prisen blev ikke ændret. Grok 4.7 koster stadig 2 dollars pr. million input tokens og 6 dollars pr. million output tokens. Cache-hits er fortsat nedsat til 0,50 dollar, og context-vinduet på 500.000 tokens er det samme som ved Grok 4.6.
Modellen udfører dog markant mere arbejde pr. svar. Artificial Analysis målte cirka 81.000 output tokens pr. Index-opgave, mod 36.000 for Grok 4.6 og 27.000 for GPT-6 Astra. Derfor giver den faste tokenpris stadig en højere regning per opgave.
Det store forbrug af tokens rammer en afdeling, der allerede har indtastet et tab på 1,26 milliarder dollars. Samtidig sagde Musk den 14. september, at Grok 4.8 ville afslutte sin træning inden for en uge.
Han forventer også, at Grok 5 bliver den model, der opnår kunstig generel intelligens. Den næste opdatering vil vise, om SpaceXAI kan avancere på ranglisten uden at skulle forbruge ekstra computerkraft.
Abonner på vores YouTube-kanal og se ledere og journalister dele indsigt









