Introductie van Grok 4.6

Grok 4.6 bouwt voort op Grok 4.5, met een specifieke focus op langlopende agents en ambitieuzer interactief en visueel werk. Het model blijft gefocust op complexe taken over meerdere stappen, of het nu gaat om het onderzoeken van een onderwerp, het analyseren van informatie, het werken in een codebase of het omzetten van een idee in een gepolijste applicatie of werkproduct.

Grok 4.6 bereikt grensverleggende intelligentie over verschillende benchmarks voor agentisch coderen en kenniswerk. Het model is gelijkwaardig aan GPT-5.6 Sol op de Artificial Analysis Intelligence Index, een gecombineerde score van negen benchmarks.

Grok 4.6 is vandaag beschikbaar in Cursor en Grok Build. Voor de eerste week bieden wij twee keer zoveel inclusief gebruik aan binnen Cursor en Grok Build.

De training van Grok 4.6

Grok 4.6 heeft een langere aanvullende trainingsronde ondergaan dan Grok 4.5, met gecureerde door het model gegenereerde data voor redeneren en geavanceerde technische concepten, hoogwaardige engineeringdata en een verbeterde optimizer en trainingsmethode. Dit zorgde voor een sterker fundament voor de daaropvolgende SFT- (Supervised Fine-Tuning) en RL-fasen (Reinforcement Learning).

Vervolgens hebben we Grok 4.5 gebruikt om de SFT-trajecten opnieuw te genereren voor redeneerinspanningen, agent-frameworks en domeinen zoals STEM, software engineering en kenniswerk. Problematische sporen zijn gefilterd met behulp van modelgebaseerde controles. Het resulterende SFT-checkpoint vertoont sterke prestaties en verbeterd gedrag.

Grok 4.6 is getraind op een breed scala aan agentische RL-taken, waaronder kenniswerk, algemeen coderen en domeinspecifieke omgevingen voor kerneloptimalisatie, webontwikkeling, computer-aided design (CAD) en meer.

Ambitieuze ideeën omzetten in werkende projecten

We hebben Grok 4.6 getest op projecten die specifiek zijn ontworpen om het bereik en het vermogen om werk over veel stappen vol te houden, op de proef te stellen. We ontdekten dat het model bijzonder sterk is in het omzetten van een breed productidee in een werkende eerste versie. Het kan onbekende domeinen onderzoeken, de applicatie structureren, de kerninteracties implementeren en het resultaat blijven verfijnen via verschillende feedbackrondes.

Bij langere trajecten zagen we bovendien meer zelf-testen en verificatie, waarbij het model zijn eigen werk controleert voordat het verdergaat.

Grok 4.6 levert sterkere eerste versies op bij visuele en interactieve projecten dan we gewoonlijk zagen bij Grok 4.5. Gegeven een concreet productidee is het in staat om in één keer de structuur en visuele taal voor een applicatie vast te stellen. Dit maakt het model bijzonder nuttig voor projecten waarbij de snelste route naar een goed resultaat is om met iets substantieels te beginnen en vervolgens iteratief te verbeteren.

Veiligheid en mogelijkheden

De beveiligingsmaatregelen van Grok 4.6 zijn verbeterd en gekalibreerd in lijn met de mogelijkheden van het model.

Onze veiligheidsstack is ontworpen om het nut en de beveiliging bij legitieme gebruiksscenario's te maximaliseren, waardoor Grok 4.6 behulpzaam en veilig kan zijn in domeinen zoals het patchen van kwetsbaarheden, het versnellen van de engineering-ontwerpcyclus en het ondersteunen van AI-onderzoek.

Ons werk aan de evaluatie van beveiligingsmaatregelen weerspiegelt de uitgebreide mogelijkheden van Grok 4.6, met onze tot nu toe breedste suite van pre-deployment testen voor capaciteiten en kalibratie, evenals uitgebreid post-deployment testen door derde partijen.

Aan de slag met Grok 4.6

Grok 4.6 is vandaag beschikbaar in Cursor en Grok Build. Het is daarnaast beschikbaar via de SpaceXAI API en via partners zoals OpenRouter, Vercel en Cloudflare.

De prijzen beginnen bij $2 per miljoen input-tokens en $6 per miljoen output-tokens. Een snelle variant is beschikbaar tegen het dubbele tarief.

Voor de eerste week bieden we 2x zoveel gebruik aan binnen Cursor en Grok Build.