Grok 4.7 julkaistu: SpaceXAI lupaa parannusta samaan hintaan ja nopeuteen
SpaceXAI julkaisi maanantaina 21.9.2026 Grok 4.7 -tekoälymallin. Yhtiön mukaan kyse on sen tähän mennessä tehokkaimmasta mallista koodaukseen ja tietotyöhön. SpaceXAI kuvaa Grok 4.7:ää merkittäväksi parannukseksi Grok 4.6:een nähden samalla hinnalla ja nopeudella. Julkaisu tuli muutama päivä aiempien syyskuun arvioiden jälkeen.
SpaceXAI julkaisi maanantaina 21.9.2026 Grok 4.7 -tekoälymallin. Yhtiön mukaan kyse on sen tähän mennessä tehokkaimmasta mallista koodaukseen ja tietotyöhön. SpaceXAI kuvaa Grok 4.7:ää merkittäväksi parannukseksi Grok 4.6:een nähden samalla hinnalla ja nopeudella. Julkaisu tuli muutama päivä aiempien syyskuun arvioiden jälkeen.
Julkaisu ja saatavuus
SpaceXAI kertoi asiasta X-tilillään maanantaina 21.9.2026 noin kello 19.17 Suomen aikaa. Viestissä lukee: “Grok 4.7 is here. It’s a notable improvement over Grok 4.6 at the same price and speed.” Julkaisulla oli tuolloin noin 820 200 näyttökertaa.
Samana päivänä ilmestyi myös virallinen uutinen x.ai-sivustolla. SpaceXAI:n mukaan Grok 4.7 työskentelee pidempään vaikeissa tehtävissä, tarkistaa omaa työtään huolellisemmin ja sisältää yhtiön tähän mennessä parhaiten kalibroidut turvasuojat.
Malli on yhtiön mukaan saatavilla Cursorissa, Grok Buildissa, Grok API:ssa sekä kolmansien osapuolten coding harness -ympäristöissä, model routereissa ja pilvialustoilla. Kehittäjädokumentaation release notes voivat vielä hetken näyttää edeltäjän Grok 4.6:n ajantasaisimpana mallina, joten julkaisutiedot kannattaa tarkistaa virallisesta uutisesta ja X-ilmoituksesta.
Mitä malli on ja mihin sitä käytetään
Grok 4.7 on suuri kielimalli (LLM), eli tekoälyjärjestelmä, joka on koulutettu käsittelemään ja tuottamaan tekstiä laajasta aineistosta. SpaceXAI korostaa erityisesti koodausta, agenttimaista työskentelyä ja tietotyötä, kuten dokumenttien ja esitysten tuottamista.
API tarkoittaa ohjelmointirajapintaa: kehittäjä voi kutsua mallia omasta sovelluksestaan. Käyttöä mitataan tokeneissa. Token on tekstin pieni käsittelyyksikkö, esimerkiksi sana tai sanan osa. Hinnat ilmoitetaan yleensä miljoonaa tokenia kohden.
Hinta ja nopeus
SpaceXAI:n mukaan Grok 4.7:n hinta alkaa 2 dollarista miljoonaa input-tokenia kohden ja 6 dollarista miljoonaa output-tokenia kohden. Nämä ovat samat lähtöhinnat kuin Grok 4.6:ssa. Lisäksi tarjolla on fast-variantti, joka tuottaa vastausta kaksi kertaa nopeammin kaksinkertaisella hinnalla.
Yhtiö markkinoi mallia myös vertailuna kilpailijoihin: sen mukaan Grok 4.7 on kaksi kertaa nopeampi ja puolet halvempi kuin vastaavat mallit. Vertailutaulukossa GPT-5.6 Sol Maxin input on 4 dollaria ja output 20 dollaria miljoonaa tokenia kohden, Fable 5.1 Maxin vastaavasti 10 ja 50 dollaria.
Suorituskyky: Grok 4.7 johtaa osassa, kilpailijat toisissa
Vertailussa Grok 4.7:n tulokset on ilmoitettu xHigh-asetuksella. xHigh tarkoittaa korkeaa päättelypanosta (reasoning effort), eli mallille annetaan enemmän laskentaa ja aikaa ennen vastausta. DeepSWE v1.1 -rivillä Grok 4.7:n 71,0 prosentin tulos on merkitty high effort -ajoksi.
Benchmark tarkoittaa standardoitua testiä, jolla mallien suorituskykyä verrataan tietyssä tehtävässä. SpaceXAI:n taulukon mukaan Grok 4.7 parantaa Grok 4.6:ta useissa mittareissa, mutta ei johda kaikissa.
| Mittari | Grok 4.7 xHigh | Grok 4.6 High | GPT-5.6 Sol Max | Fable 5.1 Max |
|---|---|---|---|---|
| Input $/M | 2 | 2 | 4 | 10 |
| Output $/M | 6 | 6 | 20 | 50 |
| CursorBench 4.0 | 46,3 % | 40,4 % | 41,7 % | 51,8 % |
| DeepSWE v1.1 | 71,0 %* | 65,2 % | 72,7 % | 70,0 % |
| EEBench | 64,0 % | 53,0 % | 39,4 % | 56,4 % |
| AA-Briefcase v1.1 | 1657 | 1546 | 1487 | 1678 |
| Terminal-Bench 4.0 | 38,0 % | 20,3 % | 37,3 % | 57,9 % |
| Harvey Legal Agent | 19,6 % | 15,8 % | 2,5 % | 6,7 % |
| HealthBench Pro | 56,7 % | 48,5 % | 60,5 % | 62,1 % |
* high effort
Grok 4.7 johtaa taulukon mukaan EEBenchissä (64,0 %) ja Harvey Legal Agent -testissä (19,6 %). Fable 5.1 Max johtaa CursorBench 4.0:ssa, AA-Briefcase v1.1:ssä, Terminal-Bench 4.0:ssa ja HealthBench Prossa. GPT-5.6 Sol Max johtaa DeepSWE v1.1:ssä (72,7 %).
Erityisen selvä hyppy Grok 4.6:een nähden näkyy Terminal-Bench 4.0:ssa: 20,3 prosentista 38,0 prosenttiin, eli tulos lähes kaksinkertaistuu. Silti Fable 5.1 Max on samassa testissä selvästi edellä 57,9 prosentilla. CursorBench 4.0:ssa SpaceXAI korostaa Grok 4.7:n hintasuorituskykyä pidemmissä koodausprosesseissa, vaikka Fable johtaa absoluuttista prosenttia.
Turvallisuus ja koulutus
SpaceXAI:n mukaan Grok 4.7:ssä on uusi safeguard-pino. LatchBio-biosafety-testissä malli sai yhtiön mukaan 62,4 prosenttia. HackerBench v0.3 -testissä vain 3,3 prosenttia riskialttiista dual-use-kehotteista meni läpi. Dual-use tarkoittaa kehotetta, jota voi käyttää sekä harmittomaan että haitalliseen tarkoitukseen. Yhtiö kertoo myös antaneensa valituille kyberturvallisuuskumppaneille kutsuvieraspääsyn Grok 4.7:n red team -ominaisuuksiin puolustustutkimukseen.
Mallin pohjana on aiempaa suurempi perusmalli. Koulutuksessa käytettiin pidempää vahvistusoppimisen (RL) ajoa vaikeammalla tehtäväsekoituksella, jossa painotus on monen tunnin tehtävissä. SpaceXAI:n mukaan malli hallitsee paremmin pidempää kontekstia ja on harjoitettu ymmärtämään Grok Bot -harnessia natiivisti.
Viive ja taustalla olleet RL-haasteet
Julkaisu viivästyi aiemmista arvioista. Elon Musk sanoi 2.9.2026, että Grok 4.7 tulisi noin 10 päivässä, mikä viittasi noin 12.9.2026:een. Hän kertoi 11.9.2026, että tarvitaan vielä muutama päivä. Syiksi hän nimesi vahvistusoppimisen vastauspituuden liian aggressiivisen penalisaation, taipumuksen lopettaa vaikeat tehtävät liian aikaisin sekä riittämättömän tiukan oman työn tarkistuksen. Julkaisu tapahtui lopulta 21.9.2026.
