Relatert til dette temaetRådet for Fremtidsteknologi og AI

Elon Musk sa at Grok 4.7 ville overgå alle modeller. Leverer det?

  • Grok 4.7 fikk 46 poeng på Artificial Analysis's Intelligence Index og havnet blant de fire beste.
  • Modellen gikk forbi GPT-5.6 Sol på koding, men gevinstene har en pris.
  • Musk sier at Grok 4.8 vil fullføre trening, og at Grok 5 vil være nær å oppnå AGI

SpaceXAI lanserte Grok 4.7, og uavhengige rangeringer plasserer den på fjerdeplass blant ledende AI-laboratorier.

Artificial Analysis, et uavhengig benchmarking-selskap, ga modellen en score på 46 på sin Intelligence Index, 2 poeng over Grok 4.6. Claude Fable 5.1, GPT-6 Astra og Claude Opus 5 rangerer alle høyere.

Grok 4.7 løfter SpaceXAI inn blant de fire beste AI-laboratoriene

Elon Musk sa før lanseringen at modellen ville bruke en base med 2,1 billioner parametere og overgå alle eksisterende modeller. Han la til at modelltreningen inkluderte data fra SpaceX.

Følg oss på X for de siste nyhetene mens de skjer

Men hvordan presterer egentlig Grok 4.7? På AA-Briefcase, en Artificial Analysis-test for realistiske profesjonelle arbeidsoppgaver, fikk Grok 4.7 en Elo-score på 1657. Det markerer et hopp på 111 poeng over Grok 4.6, og bringer modellens nivå nær Claude Opus 5.

På GDPval-AA oppnådde modellen 1695 Elo, noe som setter den 90 poeng foran forgjengeren. Resultatene innen koding gikk samme vei.

Sammen med Grok Build, dens egen kodeagent, fikk Grok 4.7 en poengsum på 56 på Coding Agent Index. Det er ni poeng over Grok 4.6.

Modellen passerte GPT-5.6 Sol og ligger nå kun bak Anthroics Claude Fable 5.1, GPT-6 Astra og Opus 5.

“Grok 4.7 oppnår 46 på Artificial Analysis Intelligence Index og bringer SpaceXAI inn blant de fire beste AI-laboratoriene. Også ytelsen på Coding Agent Index har økt, og overgår GPT-5.6 Sol,” heter det i innlegget.

Slik presterer Grok 4.7.
Slik presterer Grok 4.7. Kilde: X/Artificial Analysis

Ellers beveget modellen seg knapt. Den økte med 4,5 prosentpoeng på Terminal-Bench 4.0 og 3 poeng på GDP.pdf. Poengene sank på AA-LCR og AutomationBench-AA-testene. Grok 4.5 toppet AutomationBench i juli, noe som støttet Musks påstand om at den matchet Claude Opus.

Fremgangen har en kostnad i tokens

Prislisten er uendret. Grok 4.7 koster fortsatt $ 2 per million input-tokens og $ 6 per million output-tokens. Treff i hurtigbufferen er rabattert til $ 0,50, og 500 000-token kontekstvinduet videreføres fra Grok 4.6.

Modellen gjør imidlertid betydelig mer arbeid for hvert svar. Artificial Analysis målte omtrent 81 000 output-tokens per Index-oppgave, mot 36 000 for Grok 4.6 og 27 000 for GPT-6 Astra. Dermed gir stabil pris per token likevel en høyere regning per oppgave.

Det store tokenforbruket rammer en divisjon som allerede har rapportert et tap på $ 1,26 milliarder. Samtidig sa Musk 14. september at Grok 4.8 ville være ferdig trent innen en uke.

Han forventer også at Grok 5 blir modellen som oppnår kunstig generell intelligens. Den neste utgivelsen vil vise om SpaceXAI kan klatre videre på rangeringen uten å bruke mer regnekraft.

Abonner på vår YouTube-kanal for å se ledere og journalister dele ekspertinnsikt

https://youtu.be/IcgIaeIE7LI

Ansvarsfraskrivelse

BeInCrypto forplikter seg til upartisk og transparent rapportering. Denne nyhetsartikkelen har som mål å gi nøyaktig og aktuell informasjon. Lesere anbefales imidlertid å verifisere fakta på egen hånd og rådføre seg med en fagperson før de tar beslutninger basert på dette innholdet. Vær oppmerksom på at våre Vilkår og betingelser, vår Personvernerklæring og våre Ansvarsfraskrivelser er oppdatert.