xAI heeft Grok 4.5 voorgesteld. Het nieuwe model wordt op de eigen nieuwspagina omschreven als het slimste model van het bedrijf voor coding, agentische taken en kenniswerk.
Focus op ontwikkelaars en kenniswerk
Volgens xAI is Grok 4.5 vooral gebouwd voor technische taken. De bron noemt uitdagende Rust-, C- en C++-opdrachten, maar ook het bouwen van volledige apps op basis van één prompt. Dat maakt de release relevant voor bedrijven die AI inzetten voor softwareontwikkeling, automatisering of interne tools.
xAI publiceert ook benchmarkresultaten. Op DeepSWE 1.0 haalt Grok 4.5 volgens de pagina 62 procent pass@1. In Terminal Bench 2.1 komt het model uit op 83,3 procent en op SWE Bench Pro op 64,7 procent. De bron vergelijkt die scores met andere modellen, maar vermeldt dat cijfers van concurrenten uit hun eigen gepubliceerde kaarten of leaderboards komen.
Kosten en snelheid tellen mee
Interessant voor kmo's is niet alleen de score, maar ook de efficiëntieclaim. xAI zegt dat Grok 4.5 aan 80 tokens per seconde wordt aangeboden en ongeveer dubbel zo efficiënt met tokens omspringt als recente leidende modellen bij dezelfde taken.
Voor ondernemers en IT-teams past dat in een bredere trend: AI-modellen worden niet alleen beoordeeld op slimheid, maar ook op snelheid, kost per taak en bruikbaarheid in concrete workflows. Wie AI gebruikt voor code, rapportering of interne automatisering zal dus steeds vaker per taak afwegen welk model voldoende kwaliteit levert tegen een haalbare prijs.