Tekoälyyhtiö SpaceXAI (entinen xAI) julkaisi maanantaina Grok 4.7 -mallin kutsuen sitä kyvykkäimmäksi mallikseen koodaukseen ja tietotyöhön. Se maksaa saman verran ja vastaa yhtä nopeasti kuin edeltäjänsä Grok 4.6, ja se on välittömästi saatavilla Cursorissa, Grok Buildissa sekä Grok-rajapinnassa – ja jokainen parannusta osoittava luku on peräisin yhtiöltä itseltään.
Julkaisussa konkretiaa ei ole uusi hinta, vaan uusi sisältö saman hintalapun alla. Yhtiön mukaan Grok 4.7 on rakennettu uuden ja laajemman perusmallin päälle kuin 4.6. Se on koulutettu pidemmällä vahvistusoppimisjaksolla vaikeammalla tehtäväkokonaisuudella, jossa painotetaan useita tunteja kestäviä ongelmia, ja se on tullut paremmaksi oman työnsä tarkistamisessa ja pitkien kontekstien hallinnassa. Malli on myös koulutettu ymmärtämään suoraan yhtiön omaa agenttiympäristöä, Grok Bot -alustaa.
Rajapinnassa (API) mallin nimi on grok-4.7, ja se maksaa 2 dollaria miljoonaa syötetokenia kohden ja 6 dollaria miljoonaa vastetokenia kohden – täsmälleen saman verran kuin Grok 4.6 High. Konteksti-ikkuna on 500 000 tokenia ja tietojen ajankohtaisuus päättyy toukokuuhun 2026. Ne, jotka haluavat enemmän nopeutta, voivat valita nopean variantin, jossa on kaksinkertainen suoritusnopeus kaksinkertaiseen hintaan.
Hyödyt ovat todellisia – mutteivät kaikkialla
Yhtiö raportoi taulukon seitsemästä suorituskykytestistä (benchmark). Kolme niistä osoittaa selvää edistystä. EEBench-testissä Grok 4.7 saa tuloksen 64,0, kun 4.6 sai 53,0. Harvey Legal Agent -testissä, joka mittaa lakiagenttien työtä, yhtiö raportoi tuloksen 19,6, kun edeltäjä sai 15,8 ja kaksi vertailtua kilpailevaa mallia saivat 2,5 ja 6,7. Dramaattisin ero on Terminal-Bench 4.0 -testissä, jossa 4.7 yltää 38,0 pisteeseen vasten 4.6:n 20,3 pistettä – lähes tuplaus puolessa vuodessa.
Mutta taulukko näyttää myös, missä malli ei johda. Samassa Terminal-Bench 4.0 -testissä kilpailija Fable 5.1 saa tuloksen 57,9, mikä on selvästi Grok 4.7:n yläpuolella. CursorBench 4.0:ssa Grok 4.7 saa 46,3 pistettä Fablen 51,8:aa vastaan, ja HealthBench Professionalissa 56,7 vastaan 62,1. Yhtiön omassa Elo-mittauksessa GDPval-alustalla Grok 4.7 xHigh saa tuloksen 1 695 – sijoittuen Grok 4.6 High’n (1 605) ja GPT-6 Astra Maxin (1 542) yläpuolelle, mutta Fable 5.1 Maxin (1 735) alapuolelle.
Yhtiön oma myyntiargumentti ei siis ole kärkipaikka joka testissä, vaan hinta-laatusuhde: saman tason tuloksia 2 ja 6 dollarilla per miljoona tokenia, kun taulukon vertailumallit ovat hinnoiltaan 4/20 dollaria ja 10/50 dollaria. Mitään tuloksista ei ole riippumattomasti varmistettu, ja jokainen taulukon luku on SpaceXAI:n itsensä mittaama ja julkaisema.
Kaupunkiympäristön rakennuspeli demina
Konkreettisena esimerkkinä yhtiö näyttää molemmat malliversiot saman tehtävän parissa: avoimen maailman kaupunginrakennuspelin luomisessa. Grok 4.7 näytetään ensin, Grok 4.6 sen jälkeen. Tämä on juuri sellainen tehtävä, johon pidemmän koulutuksen sanotaan tähtäävän – useita tunteja kestävä työ, jossa mallin on pidettävä koodi, rakenne ja omat tarkistuksensa koossa pitkän matkan ajan ilman, että ihminen ohjaa jokaista askelta.
Yhtiö valitsi demon itse, eikä se kerro mitään siitä, miten malli käyttäytyy todellisessa koodikannassa todellisella asiakkaalla. Se kuitenkin havainnollistaa koko alan suuntaa: kilpailu on siirtynyt nopeista vastauksista agentteihin, jotka jatkavat työtään itsenäisesti tuntikausia. Tässä toimittajat nyt kirittävät toisiaan, ja tässä myös virheet tulevat kalliiksi, sillä pitkään ilman valvontaa työskentelevä malli voi ehtiä tehdä paljon ennen kuin kukaan huomaa sen olevan väärillä jäljillä.
Turvakerros ja luvut, jotka eivät ole sata
SpaceXAI kuvailee Grok 4.7:ää yhtiön tähän asti parhaiten kalibroidulla turvakerroksella – täysin uudella niin sanotulla suojapinolla (safeguard stack), jonka yhtiö sanoo olevan vahvin kieltäytymisessä ja ”jailbreak”-yritysten vastustamisessa. Julkisuuteen annettiin kaksi lukua. HackerBench v0.3 -testissä 3,3 prosenttia riskialttiista kaksoiskäyttökehotteista pääsee läpi. LatchBios-bioturvallisuusmittauksessa raportoidaan tulos 62,4 prosenttia.
Toisin sanoen: hieman useampi kuin kolme sadasta riskialttiista pyynnöstä menee edelleen läpi, ja bioturvallisuustulos on kaukana täydellisestä pistemäärästä. Yhtiö on myös kutsunut valittuja kyberturvallisuuskumppaneita suljettuihin ”red-team”-harjoituksiin puolustustutkimusta varten. Kumppaneita ei nimetty, ja julkaistut luvut ovat yhtiön omia mittauksia yhtiön omilla testisarjoilla.
Missä malli on saatavilla – ja mitä tapahtuu nyt
Saatavuus ratkaisee sen, kuinka nopeasti julkaisu saa käytännön merkitystä. Grok 4.7 on saatavilla ensimmäisestä päivästä lähtien Cursorissa ja Grok Buildissa sekä Grok-rajapinnassa, ja lisäksi kolmannen osapuolen koodausympäristöjen, mallireitittimien ja pilvipalveluiden kautta. Jokainen, joka jo ajaa grok-4.6-mallia tuotannossa, vaihtaa käytännössä mallin nimen koskematta budjettiin.
Tahti on huomioitavan arvoinen. Heinäkuussa julkaistiin Grok 4.5 samaan hintaan, 2 ja 6 dollaria miljoonaa tokenia kohden, ja samalla 500 000 tokenin konteksti-ikkunalla. Sen jälkeen yhtiö on vaihtanut nimeään, ohittanut version 4.6 ja nyt 4.7 – muuttamatta hintaa kertaakaan. Hinnastosta on tullut alan kiintopiste, kun taas sen alla olevat mallit vaihtuvat kuukausittain.
Se, mitä asiakas tosiasiallisesti saa muuttumattomalla 2 ja 6 dollarilla, ei siis ratkea taulukoiden perusteella, vaan sen mukaan, miten uusi malli käyttäytyy tuntikausia kestävissä agenttiajoissa yrityksissä, jotka antavat sen työskennellä omien järjestelmiensä sisällä. Tuo testi alkaa nyt, ja sen tekevät muut kuin yhtiö itse.
EU-mafian kosto Brexitistä?
Ylewatch-blogistilta taas osuvaa tekstiä:
”ISLAMILAINEN RULETTI MANCHESTERISSÄ
Poliittis-taloudellisen pseudoeliitin Eurooppaan päästämien islamilaisten terrori-ruletti osui tällä kertaa Iso-Britannian Manchesteriin.
…
Läntisiä kansakuntia hallitseva globalistinen ”eliitti” ei yksin ole syyllinen siihen, että Eurooppaa miehittää käenpoikien väestö, josta muiden vakavien ongelmien lisäksi sikiää myös terrorismi. Ranskalaisten, saksalaisten, belgialaisten ja ruotsalaisten tapaan myös britit ovat pitkälti muukalaisten aisankannattajia, koska he eivät ole äänestyskopeissa rasismin pelossa uskaltaneet äänestää edes niitä, jotka haluavat ainoastaan hidastaa kolmannen maailman invaasiota. He ovat tieten tahtoen valinneet valtaan ne, jotka päästävät maahan muukalaisia, joista matemaattisella varmuudella tietty osa syyllistyy paikallisväestön murhaamiseen joko terrorismin tai arkisen katuväkivallan muodossa.
Vaikka täällä Euroopan pienessä koilliskolkassa ei ole vielä tapahtunutkaan islamilaisten terrori-iskua, saattaa se ennen pitkää olla todennäköistä, koska poliittinen johtomme ei tee mitään ei-eurooppalaisen vierasväestön vyörymiselle maailman ainoaan suomalaisten kotimaahan. Nimittäin 17. toukokuuta Yle kertoi uutisen, jonka mukaan Maahanmuutto ennätyslukemiin viime vuonna – Suomesta lähteneiden määrä myös kasvussa. Huolestuttavinta uutisjutussa on se, että maahanmuutto kiihtyi etenkin EU:n ulkopuolelta huomattavasti.
Tietysti suurin vastuu yhteiskunnallisesta epävakaudesta lankeaa viime kädessä valituille politiikoille sekä näkyville mielipidejohtajille. Kansa voi olla harhaanjohdettua kuten Suomessa vuonna 1918, mutta päättäjien pitäisi olla aina tietoisia ratkaisujensa seurauksista. Siksi poliitikot ja intellektuellit, jotka edesauttavat kantaväestön syrjäyttämistä kolmannen maailman maahantunkeutujilla, eivät ole muuta kuin islamilaisen vihollisen yhteistoimintamiehiä, kollaboraattoreita. Sellaisina heitä pitäisi myös kohdella.
Euroopan kansojen säilymiseen vihamielisesti suhtautuva poliittinen, taloudellinen ja kulttuurinen ”eliitti” on massiivisella propagandallaan onnistunut vaalikarjan pään kääntämisessä, jossa ensisijaisessa roolissa on ollut nationalismin demonisointi. Toisena indoktrinaation lähteenä on loppumaton hokema, jonka mukaan diversiteetti eli moninaisuus on rikkaus ja voimamme. Tosin kiihtyvän islamilaisen terrorismin myötä kovakalloisemmallekin monikultturistille on käymässä selväksi, että ”voimavaraa” löytyy enää vain virallisista juhlapuheista ja kympin tyttöjen ainekirjoituksista…”
Koko artikkeli: http://ylewatch.blogspot.fi/2017/05/islamilainen-ruletti-manchesterissa.html