SpaceXAI je ceno novega modela pustil točno tam, kjer je bila: 2 USD za milijon vhodnih in 6 USD za milijon izhodnih žetonov. Pri modelu Grok 4.7, ki je izšel 21. septembra 2026, se je spremenilo to, koliko dela opravi za ta denar in koliko žetonov pri tem porabi.
Grok 4.7 je po navedbah podjetja njegov »najzmogljivejši model za programiranje in delo z znanjem« in prvi novi paradni model, odkar je SpaceX avgusta dokončal nakup podjetja Cursor, ki razvija urejevalnik kode z umetno inteligenco. Že prvi dan je bil na voljo v Cursorju in v lastnem programerskem orodju Grok Build, pa tudi prek vmesnika Grok API. SpaceXAI je nekdanji xAI: SpaceX je podjetje Elona Muska za umetno inteligenco prevzel februarja, njegove delnice pa so na borzi Nasdaq začele trgovati 12. junija. Kaj razvijalci dobijo, je preprosto povedati, težje pa preračunati v denar: boljše rezultate kot pri modelu Grok 4.6 po isti ceni, a model, ki dlje razmišlja.
- Kaj: Grok 4.7, novi model podjetja SpaceXAI za programiranje in dolge pisarniške naloge, zgrajen na večjem osnovnem modelu kot Grok 4.6.
- Cena: 2 USD za milijon vhodnih in 6 USD za milijon izhodnih žetonov, nespremenjeno; hitrejša različica stane dvakrat več za dvakrat hitrejši izpis.
- Zakaj je pomembno: neodvisni testi ga uvrščajo med štiri najboljše programerske agente, a za nalogo porabi več kot dvakrat toliko izhodnih žetonov kot Grok 4.6.
Kaj je SpaceXAI spremenil
Po objavi podjetja SpaceXAI Grok 4.7 »uporablja nov, večji osnovni model« kot Grok 4.6, učili pa so ga z daljšim krogom spodbujevalnega učenja, »usmerjenim v probleme, katerih reševanje traja več ur«. Podjetje pravi, da model bolj skrbno preverja svoje delo, bolje obvladuje dolg kontekst in je naučen delovati neposredno v okolju Grok Bot, agentnem izdelku podjetja. Števila parametrov ni objavilo. Kontekstno okno ostaja pri 500.000 žetonih, predpomnjeni vhod stane 0,50 USD za milijon žetonov, oboje enako kot pri modelu Grok 4.6, je poročala Artificial Analysis.
Glede varnosti SpaceXAI pravi, da ima Grok 4.7 »povsem nov sklop varoval«, in ga opisuje kot »najmočnejši model, kar smo jih preizkusili, pri zavračanju in odpornosti proti poskusom obida varoval«. Na lastnem testu tveganih kibernetskih zahtev HackerBench v0.3 je prepustil 3,3 odstotka tveganih zahtev z dvojno rabo. Izbrani varnostni partnerji lahko njegove zmožnosti za napadalno testiranje na povabilo uporabljajo za obrambne raziskave.
Proizvajalčeva lestvica
Primerjalna tabela podjetja SpaceXAI kaže velik napredek glede na Grok 4.6 in mešano sliko v primerjavi s tekmeci. Spodnji podatki so proizvajalčevi, pri nastavitvah sklepanja, ki jih je izbral SpaceXAI (xHigh za Grok 4.7, Max za oba tekmeca). Tabela Grok 4.7 primerja z OpenAI-jevim GPT-5.6 Sol in Anthropicovim Claude Fable 5.1. OpenAI-jev GPT-6 Astra se pojavi le v ločenem grafu GDPval s strokovnimi nalogami, kjer mu je SpaceXAI pripisal 1.542 točk Elo, modelu Grok 4.7 1.695 in modelu Fable 5.1 1.735.
| Test (podatki proizvajalca) | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Claude Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 (programiranje) | 46,3 % | 40,4 % | 41,7 % | 51,8 % |
| DeepSWE v1.1 (programski inženiring) | 71,0 % (visok napor) | 65,2 % | 72,7 % | 70,0 % |
| Terminal-Bench 4.0 (večurno delo v terminalu) | 37,6 % | 20,3 % | 37,3 % | 57,9 % |
| EEBench (elektrotehnika) | 64,0 % | 53,0 % | 39,4 % | 56,4 % |
| HealthBench Professional | 56,7 % | 48,5 % | 60,5 % | 62,1 % |
| Cena po navedbah SpaceXAI, USD za milijon vhodnih / izhodnih žetonov | 2 / 6 | 2 / 6 | 4 / 20 | 10 / 50 |
Grok 4.7 vodi pri elektrotehniki in na Harveyjevem testu pravnega agenta, kjer SpaceXAI navaja 19,6 odstotka proti 6,7 odstotka za Fable 5.1. Za Fable 5.1 pa očitno zaostaja pri dolgem delu v terminalu in na testu CursorBench, ki ga je pripravil sam Cursor.
Kaj so ugotovili neodvisni preizkuševalci
Artificial Analysis, ki vse modele preverja z enakimi standardiziranimi testi, je rezultate objavila na dan izida. Grok 4.7 je na njenem indeksu Intelligence Index dosegel 46 točk, dve več kot Grok 4.6. Večji je bil napredek pri dolgem pisarniškem delu: 1.657 točk Elo na testu AA-Briefcase, 111 več kot Grok 4.6 in »tik za modeloma Claude Opus 5 in Claude Fable 5.1«. Skupaj z orodjem Grok Build je na indeksu programerskih agentov Coding Agent Index dosegel 56 točk, devet več kot prej, kar ga med modeli v lastnih programerskih orodjih uvršča na četrto mesto, za Claude Fable 5.1, GPT-6 Astra in Claude Opus 5.
Zatakne se pri porabi. Grok 4.7 je za nalogo porabil več kot dvakrat toliko izhodnih žetonov kot Grok 4.6 in približno trikrat toliko kot GPT-6 Astra. Pri nespremenjeni ceni na žeton pomeni več kot dvakrat več žetonov višji račun za isto delo, pa tudi počasnejše delo: družba je izmerila povprečno približno 7,1 minute na nalogo. Natančnost na testu znanja AA-Omniscience je ostala približno enaka, delež halucinacij pa je padel s 34 na 29 odstotkov.
Zakaj je Cursor pomemben
To izdajo od drugih loči distribucija. SpaceX se je s Cursorjem aprila dogovoril za sodelovanje, ki mu je dalo možnost nakupa podjetja za 60 milijard USD, sredi avgusta pa je Cursor sporočil, da je uradno del družbe SpaceX in da ima »dostop do največjega parka grafičnih procesorjev na svetu«, je poročal TechCrunch. Grok 4.7 je bil v Cursorju na voljo na dan izida, je zapisal TestingCatalog.
Eden od drugih Cursorjevih dobaviteljev se je že odzval. OpenAI je 29. avgusta sporočil, da bo Cursorju 12. novembra nehal dobavljati modele, ker ne more zaupati, da bo SpaceX njegovo tehnologijo uporabljal v skladu s pogoji uporabe, in to »na podlagi naših izkušenj s podjetji Elona Muska, ki kršijo pogodbe«, je poročal The Next Web. Od tega dne OpenAI-jevih modelov v urejevalniku ne bo več, modeli podjetja SpaceXAI pa so vanj vgrajeni od prvega dne.





Komentarji
Komentarje pregledamo, preden jih objavimo.
Komentarjev še ni. Bodite prvi.