Elon Musk legt de lat voor Grok opnieuw hoger. Volgens hem heeft Grok 4.7 een goede kans om alle
AI-modellen die nu beschikbaar zijn op intelligentie te verslaan.
Dat is voorlopig marketing met een houdbaarheidsdatum. Grok 4.7 is nog niet publiek getest en onafhankelijke benchmarks ontbreken. Maar de claim valt op omdat SpaceXAI met Grok 4.6 nog maar één punt achter Claude Fable 5 staat op een belangrijke samengestelde AI-test.
Musk erkent dat Fable 5 nu nog voorligt
Musk maakte de vergelijking zelf op X.
Hij schreef dat Claude Fable 5 momenteel overall slimmer is dan Grok 4.6. Daar zette hij tegenover dat Grok volgens hem veel sneller en goedkoper is. Daarna volgde zijn voorspelling over Grok 4.7.
Dat onderscheid telt.
Musk zegt niet dat een huidig Grok-model Anthropic al heeft verslagen. Hij voorspelt dat de volgende versie dat mogelijk doet.
Voor Grok 4.7 bestaat nog geen openbare benchmark waarmee die uitspraak kan worden gecontroleerd.
Grok 4.6 staat één punt achter Fable 5
De huidige cijfers maken Musks gok wel interessanter.
SpaceXAI
bracht Grok 4.6 op 12 augustus uit. Het model richt zich sterk op langdurige agenttaken, softwarewerk en opdrachten waarbij meerdere stappen en tools nodig zijn.
Op de Artificial Analysis Intelligence Index behaalt Grok 4.6 een score van 61.
Claude Fable 5 staat op 62. Claude Opus 5 scoort 63.
Die index combineert verschillende tests voor onder meer redeneren, kennis, softwaretaken en probleemoplossing. Eén punt verschil betekent dus niet dat twee modellen op iedere taak vrijwel identiek presteren.
Het laat wel zien dat SpaceXAI weer dicht bij de kopgroep zit.
Vijf punten winst in één modelstap
De snelheid waarmee dat gat kleiner werd, valt minstens zo sterk op.
Grok 4.5 scoorde 56 op dezelfde Intelligence Index. Grok 4.6 kwam enkele weken later uit op 61. Vergeleken met Grok 4.3 bedraagt de vooruitgang volgens Artificial Analysis zelfs 23 punten.
Daar zit Musks weddenschap.
Als SpaceXAI nogmaals een grote modelsprong kan maken, komt de eerste plaats mathematisch snel binnen bereik.
Alleen werkt de concurrentie niet met stilstaande doelen.
Anthropic, OpenAI, Google en andere labs kunnen nieuwe versies uitbrengen voordat Grok 4.7 publiek beschikbaar wordt.
Grok 4.7 hoeft dus niet alleen de modellen van vandaag te verslaan. Het moet bij zijn release opboksen tegen wat de concurrentie tegen die tijd heeft gebouwd.
Grok voert vooral oorlog via de prijs
De tweede helft van Musks boodschap is misschien commerciëler.
SpaceXAI rekent voor Grok 4.6 $2 per miljoen inputtokens en $6 per miljoen outputtokens. Het model heeft een venster van 500.000 tokens. (
SpaceXAI)
Anthropic rekent voor Claude Fable 5 officieel $10 per miljoen inputtokens en $50 per miljoen outputtokens. (
Anthropic)
Dat prijsverschil is fors.
Een bedrijf dat een paar losse moeilijke vragen laat beantwoorden, kan maximale intelligentie verkiezen boven kosten. Bij miljoenen modelaanroepen of autonome agenttaken verandert de rekensom.
Dan wordt prijs per bruikbare taak een harde bedrijfsmeter.
Musks snelheidsclaim is minder duidelijk
Bij snelheid verdient Musk meer tegenwicht.
Artificial Analysis meet Grok 4.6 op ongeveer 61 outputtokens per seconde. Voor Fable 5 ligt de gemeten uitvoersnelheid rond 68 tokens per seconde.
Dat ondersteunt dus niet simpelweg de stelling dat Grok altijd sneller tekst genereert.
Snelheid kan alleen op meerdere manieren worden gemeten.
Een model kan eerder beginnen met antwoorden, minder redeneerstappen nodig hebben of een volledige agenttaak sneller afronden. Alleen naar outputtokens per seconde kijken vertelt daarom ook niet het hele verhaal.
De veilige conclusie blijft: Grok is aantoonbaar goedkoper, terwijl de algemene snelheidsclaim afhangt van wat precies wordt gemeten.
Agenttaken worden belangrijker dan één benchmark
Dat is precies waar de AI-race naartoe schuift.
Grok 4.6 scoort sterk op tests waarbij modellen langere opdrachten zelfstandig moeten uitvoeren. Artificial Analysis noemt onder meer sterke resultaten op kenniswerk, toolgebruik en terminaltaken.
SpaceXAI positioneert het model zelf eveneens voor langlopende agents.
De onderneming lanceerde op 11 augustus ook
Grok Bot. Die agents krijgen een eigen computer in de cloud en kunnen zelfstandig door websites, bestanden en andere software werken.
Dat verandert de economische maatstaf.
Een model hoeft niet alleen een goed antwoord te produceren. Het moet een taak kunnen afmaken zonder dat een mens na iedere stap opnieuw moet ingrijpen.
Goedkopere agents maken miljoenen taken haalbaarder
Daar wordt prijs opnieuw gevaarlijk belangrijk.
Stel dat twee modellen ongeveer dezelfde kwaliteit leveren, maar het ene kost per taak een veelvoud van het andere.
Bij duizend opdrachten valt dat misschien te dragen.
Bij miljoenen autonome taken wordt het een compleet ander bedrijfsmodel.
AI-agents kunnen voortdurend code controleren, onderzoek uitvoeren, klantvragen verwerken of andere software bedienen. Iedere extra redeneerstap en ieder token wordt dan onderdeel van de kostprijs.
De winnaar hoeft daardoor niet per se iedere benchmark te domineren.
Hij moet goed genoeg zijn tegen een prijs waarbij de agent geld oplevert.
Voor crypto zit de kans bij agents die zelf mogen betalen
Daar ontstaat ook de koppeling met crypto.
Een agent die zelfstandig online werkt, kan uiteindelijk diensten moeten inkopen. Denk aan data, rekencapaciteit, API's of digitale producten.
CryptoBenelux schreef eerder hoe
x402 als betaalrail voor AI-agents wordt ontwikkeld.
Zulke systemen kunnen software rechtstreeks laten betalen zonder traditionele checkout.
Daarvoor zijn duidelijke bestedingslimieten en
wallets nodig. Ook
stablecoins kunnen interessant worden wanneer een agent bedragen moet gebruiken die stabiel in dollars of euro's blijven.
Dat betekent niet dat Grok 4.7 automatisch een cryptoverhaal is.
De link ontstaat pas wanneer autonome modellen daadwerkelijk toestemming krijgen om zelfstandig economische handelingen uit te voeren.
De echte test begint pas na de release
Musk heeft vaker agressieve doelen rond Grok uitgesproken. Deze keer staat SpaceXAI in ieder geval dichter bij de top voordat de voorspelling wordt gedaan.
Grok 4.6 scoort 61. Fable 5 staat op 62. Het prijsverschil is groot.
Maar Grok 4.7 heeft zelf nog precies nul onafhankelijke openbare benchmarkpunten.
Daarmee blijft Musks voorspelling voorlopig wat hij is: een claim over een model dat buiten SpaceXAI nog niemand volledig kan beoordelen.
Interessanter wordt wat er gebeurt als de intelligentie inderdaad stijgt en de prijs rond het huidige niveau blijft.
Dan hoeft Grok 4.7 niet eens iedere benchmark te winnen om de markt pijn te doen.