- 0
- 522 words
xAI lancerer Grok 4.7 til kodning og vidensarbejde — stærkere end 4.6, men midterfelt på uafhængige målinger
Islamabad / København — 22. sep. 2026 (PKT). xAI har udgivet Grok 4.7 og kalder den selskabets hidtil mest kapable Grok til kodning og vidensarbejde. Modellen landede omkring 21. september 2026 og dukker allerede op i udviklerværktøjer — samtidig med at uafhængige scorecards placerer den midt i feltet frem for helt i top.
Hvad xAI siger er nyt
Ifølge xAI’s lanceringsnote bygger Grok 4.7 på en større basismodel end Grok 4.6. Selskabet fortæller, at det har kørt længere reinforcement learning — en træningsform, der belønner modellen for at løse sværere problemer — på opgaver, der kan tage mange timer. xAI hævder også bedre selvverifikation (at modellen tjekker egne svar), stærkere håndtering af lang kontekst og native træning på Grok Bot-harness’en til samtale- og agentarbejde.
En ny safeguard-stack indgår i fortællingen. xAI kalder den sit bedst kalibrerede sikkerhedssystem hidtil. Det er virksomhedspåstande; eksterne laboratorier har endnu ikke offentliggjort en fuld, uafhængig sikkerhedsaudit af stakken.
Pris og tilgængelighed
Prisen matcher Grok 4.6: fra 2 dollar pr. million input-tokens og 6 dollar pr. million output-tokens. Der findes også en hurtig variant med dobbelt output-hastighed til dobbelt pris. Ifølge selskabet er modellen tilgængelig i Cursor, Grok Build, via Grok API, tredjeparts kode-harnesses og cloud-platforme.
Separat skrev GitHub i sit changelog den 21. september 2026, at Grok 4.7 rulles ud i GitHub Copilot til Pro, Pro+, Max, Business og Enterprise — i VS Code, Visual Studio, JetBrains og andre Copilot-flader. Udrulningen er gradvis, understregede GitHub.
Virksomhedens egne benchmarks — tilskriv xAI
xAI offentliggjorde sin egen sammenligningstabel. På CursorBench 4.0, der belaster længere kodningsopgaver, scorede Grok 4.7 46,3 % mod 40,4 % for Grok 4.6. På Terminal-Bench 4.0 var springet større: 38,0 % mod 20,3 %. På EEBench, en elektroteknisk test, rapporterede xAI 64 %. Selskabet viste også fremskridt på fler-timers kontorarbejde og flere professionelle domænetests.
Tallene kommer fra leverandøren. De forklarer budskabet “bedre end 4.6” — især pris/ydelse på CursorBench — men erstatter ikke tredjepartsevaluering.
Uafhængig dækning: midterfelt, ikke loftet
Balanceret journalistik er vigtig her. Artificial Analysis gav Grok 4.7 46 på Intelligence Index — bedre end Grok 4.6, men stadig bag ledere som Claude Fable 5.1 og GPT-6 (omkring 53 på samme indeks ifølge The Decoder). Både Decrypt og The Decoder beskrev udgivelsen som et solidt skridt frem, der stadig ligger bag Anthropic- og OpenAI-modeller på flere offentlige indeks.
Kort sagt: Grok 4.7 ser mere nyttig ud for udviklere, der allerede arbejder i Cursor, Copilot eller Grok API — især hvis pris og hastighed tæller lige så meget som rå leaderboard-placering. På dagens uafhængige lister er den ikke den ubestridte frontier-leder.
Kort sagt
For læsere, der følger AI-værktøjsracet i 2026, er Grok 4.7 en opgradering til samme pris med klarere kodeagent-fokus og bredere distribution. Stol på selskabets egne bænke for historien “bedre end 4.6”. Stol på uafhængige indeks for placeringen over for Claude Fable 5.1 og GPT-6. Begge historier kan være sande på samme tid.