Video on kuvattu Minneapoliksessa USA:ssa, ja julkaistu 10.07.2017.
https://nykysuomi.com/islannin-vastaus-pisa-pohjakosketukseen-uusia-oppikirjoja-ja-kannykkavapaat-koulut/
Islannin hallitus vastaa kaikkien aikojen huonoimpiin PISA-tuloksiin 455 miljoonan Islannin kruunun paketilla, joka sisältää uusia oppimateriaaleja, kännykkävapaita kouluja ja opetussuunnitelman tarkistuksen. Opettajien ammattiliiton mukaan paketti ei kuitenkaan puutu opettajapulaan.
PISA 2025 -tulokset julkaistiin 8. syyskuuta. Tulokset mitattiin islantilaisten peruskoululaisten osalta. Islanti sijoittui 33. sijalle 38 OECD-maan joukossa. Vain 2 prosenttia saavuttaa huipputason luetun ymmärtämisessä, kun OECD:n keskiarvo on 6 prosenttia.
Samana päivänä lapsi- ja opetusministeri Inga Saeland piti tiedotustilaisuuden hallituksen vastatoimista.
— Olemme saavuttaneet pohjan. On oikeastaan vain yksi suunta, ja se on ylöspäin, sanoo Inga Saeland.
Magnus Thor Jonsson on opettajien ammattiliitto Kennarasamband Islandsia puheenjohtaja. Hän kutsuu aloitetta hyväksi aluksi, mutta haluaisi nähdä suuremman summan.
— Meille on valtavan tärkeää opettajien ammatillisen kehittymisen vahvistaminen. Peruskouluista puuttuu tällä hetkellä noin 20 prosenttia tarvittavista ammatillisesti pätevistä opettajista, sanoo Magnus Thor Jonsson.
Hän kuvailee, mihin tämä johtaa. Kun oppimateriaalit ovat samanaikaisesti heikkoja, opettajat, joilla ei välttämättä ole edes ammatillista pätevyyttä, joutuvat opettamaan ryhmiä ja kirjoittamaan materiaalit itse.
https://nykysuomi.com/openai-tekoalymme-on-ratkaissut-yhden-matematiikan-seitsemasta-millennium-ongelmasta/
OpenAI ilmoittaa ratkaisseensa yhden matematiikan seitsemästä Millennium-palkinto-ongelmasta. Yhtiön mukaan noin 10 000 samanaikaisesti työskentelevää tekoälyagenttia osoitti 88 tunnissa, että Navier–Stokesin yhtälöiden ratkaisut voivat luhistua äärellisessä ajassa – työn takana oli sisäinen malli, jota yhtiö kuvailee huomattavasti kyvykkäämmäksi kuin hiljattain julkaistua GPT-6 Astraa.
Yhtiö esittelee sekä analyyttisen todistuksen että formalisoinnin Lean-todistuksentarkistuskielellä. Sen selvityksen mukaan tulos vahvistaa vaihtoehdot C – ja myös D – Clay Mathematics Instituten virallisessa ongelmanasettelussa: sileiden ratkaisujen luhistumisen sekä koko avaruudessa että mallissa, jossa avaruus toistuu jaksollisesti joka suuntaan. Molemmat vaihtoehdot ovat päteviä reittejä ongelman ratkaisemiseen. Sen osoittaminen, että yhtälöt voivat epäonnistua, vastaa kysymykseen yhtä lailla kuin sen osoittaminen, etteivät ne koskaan tee niin.
Navier–Stokesin yhtälöt ovat Newtonin toinen laki kirjoitettuna nesteille ja kaasuille, käsitellen virtausta jatkuvana väliaineena sen sijaan, että seurattaisiin jokaista molekyyliä. Niitä käytetään lentokoneiden siivissä, sääennusteissa ja veren virtauksessa. Kysymys, joka on pysynyt avoimena 90 vuotta, on se, voiko tämä kuvaus luhistua: voivatko nopeudet kasvaa rajatta äärellisessä ajassa, vaikka viskositeetti pyrkii jatkuvasti tasoittamaan liikettettä?
Vastaus OpenAI:n todistuksessa on kyllä. Rakenne on pyörre, joka kiertelee sisäänpäin samalla kun se venyy kuin spaghetti. Sen keskusalue kutistuu ja kiihtyy, mutta nesteen energia säilyy äärellisenä. Nesteeseen vaikuttavaa ulkoista voimaa kuvataan sileäksi, mikä tarkoittaa voimaa, joka vaihtelee tasaisesti ja säännöllisesti ilman hyppyjä tai äärettömiä piikkejä – mitään ääretöntä voimaa ei ole lisätty käsin. Yhtiön mukaan kiihtyvyyden, painegradientin, liikemäärän ja viskositeetin termien on tultava erittäin suuriksi, mutta niiden on kumottava toisensa erittäin tarkasti.
Avaa julkaisu X:ssä
Ratkaistavana on matemaattinen kysymys yhtälöiden pätevyydestä, ei turbulenssi fysikaalisena ilmiönä. Jos singulariteetti voi syntyä, se tarkoittaa, että tämä tietty matemaattinen kuvaus lakkaa pätemästä kyseisessä pisteessä. Todistus koskee siis virtaavien nesteiden ja kaasujen matemaattista mallia – se ei selitä, miten ratkaistaan käytännön turbulenssiongelmia, jotka liittyvät siipiin, sääennusteisiin tai verenkiertoon.
Reitti sinne kulki yksinkertaisemman ongelman kautta. Yhtiö sanoo kouluttaneensa uutta sisäistä mallia elokuun 28. päivästä lähtien ja että työ Millennium-ongelmien parissa alkoi 1. syyskuuta sen jälkeen, kun liikkui huhuja kahden niistä tulleen ratkaistuksi. Erilliset agenttiryhmät saivat erilaisia versioita ongelmanasettelusta: A ja B, jotka tuottaisivat todistuksen, sekä C ja D, jotka tuottaisivat kumouksen. Eulerin yhtälöt murtuivat ensin: rajatapaus ilman viskositeettia, jossa hieman alle 100 agenttia työskenteli noin 50 tuntia ja kumosi säännöllisyyden versiossa, jossa nesteeseen ei vaikuta lainkaan ulkoista voimaa. Resurssit suunnattiin tämän jälkeen Navier–Stokesiin.
Ratkaisu syntyi lauantaina 5. syyskuuta, 88 tuntia aloituksen jälkeen. Yhtiön mukaan formalisointi ja varmistus Leanilla kesti vielä 17 tuntia GPT-6 Astran avulla. Pelkästään Navier–Stokesia varten agentit lähettivät 2,7 miljoonaa viestiä ja kuluttivat noin 130 miljardia lähtötokenia – mittari sille, kuinka paljon tekstiä järjestelmä tuotti työn aikana.
Yhtiön oma selonteko ei väitä, että malli olisi ratkaissut ongelman yksinään. Tutkijat valitsivat ongelman muunnelmat, syöttivät onnistuneelle ryhmälle Euler-tuloksen, vaihtoivat uudempaan malliversioon työn aikana ja käyttivät Codex-koodaustyökalua yhdistämään hyödyllisimmät oivallukset ryhmien välillä. Ratkaisun löytänyttä ryhmää ohjattiin tällä tavalla.
Samaan aikaan NYU:n matematiikan professori Tristan Buckmaster ja Anthropicin työntekijä Levent Alpöge olivat edistäneet omaa tutkimusohjelmaansa, joka perustui Diego Córdoban ja Luis Martínez-Zoroan työhön, ja saavuttaneet luhistumisen sileällä ulkoisella pakotteella huokoisissa aineissa, Boussinesq-yhtälöissä ja kolmiulotteisessa Eulerissa. Julkaistussa lausunnossaan Buckmaster kuvailee, kuinka keskusteluissa OpenAI:n kanssa 6. syyskuuta hänelle kerrottiin, että sisäinen järjestelmä oli ratkaissut Navier–Stokesin ulkoisella pakotteella, ja hänelle tarjottiin mahdollisuutta kirjoittaa artikkeli tuloksesta itse. Hänen selontekonsa mukaan OpenAI-tutkija Sebastien Bubeck totesi kahdesti, että Alpöge tulisi poistaa tekijöistä. Buckmaster kieltäytyi ja korosti, ettei hän ollut nähnyt todistusta eikä syyttänyt ketään mistään.
OpenAI sanoo tarjonneensa samanaikaista julkaisua ja pääsyä kehotteisiinsa (prompts), tunnustaa kaksikon etuoikeuden ulkoisella pakotteella varustettuun Euleriin ja sanoo, etteivät sen tutkijat tai agentit olleet nähneet heidän työtään ennen sen julkista julkaisua. Se ilmoittaa, ettei mitään tiettyjä käyttäjätietoja ole käytetty. Samalla yhtiö kirjoittaa, ettei se voi sulkea pois sitä, että anonymisoitu data kaksikon käyttämistä tuotteista olisi auttanut mallien parantamisessa. Lehdistötilaisuudessa Bubeck kielsi yhtiön käyttäneen heidän työtään.
Lean-tiedostot ovat julkisesti saatavilla GitHubissa, ja OpenAI sanoo, että todistusketju on siten konevarmistettu. Se ei ole sama asia kuin matematiikkayhteisön hyväksyntä. Clay Mathematics Instituten säännöt vaativat julkaisua hyväksytyssä tieteellisessä julkaisussa, vähintään kahden vuoden odotusajan ja yleisen hyväksynnän maailmanlaajuisessa matematiikkayhteisössä – eikä instituutti ota vastaan suoria hakemuksia. OpenAI ilmoittaa, ettei se aio lunastaa miljoonan dollarin palkintoa.
https://nykysuomi.com/huthit-ovat-vallanneet-mochan-nyt-taistelu-kaydaan-bab-el-mandebista/
Huthit ovat ottaneet haluunsa Punaisenmeren satamakaupunki Mochan, kertovat neljä Jemenin hallituksen puolella olevaa sotilaslähdettä. Samaan aikaan Hanish-saaret ovat hyökkäyksen kohteena ja hallituksen joukot ryhmittyvät uudelleen etelämmäs kohti Dhubabia – kaupunkia, joka yhdessä Perimin saaren kanssa määrittää, kuka hallitsee Bab el-Mandebia, yhtä maailman tärkeimmistä öljyn ja rahtitavaran merireiteistä.
Reutersin välittämät tiedot Mochasta ovat peräisin kansainvälisesti tunnustetun hallituksen armeijan neljältä lähteeltä. Samojen lähteiden mukaan liike on aloittanut hyökkäykset Hanish-saarille Punaisenmeren eteläosassa, kun taas hallituksen joukot ja niiden liittolaiset siirtyvät etelään kohti Dhubabia, joka sijaitsee suoraan salmen rannalla vastapäätä Perimiä.
Dhubabin ja saaren hallinta on lähteiden mukaan avain itse salmen hallintaan. Salmen saartoa ei ole vahvistettu. Kuvattu tilanne on asemian siirtyminen yhden maailman tärkeimmän merenkulun pullonkaulan ympärillä.
Bab el-Mandeb, "Kyynelten portti", on Punaisenmeren eteläinen ulospääsyväylä Arabian niemimaalla sijaitsevan Jemenin sekä Afrikan puolella sijaitsevien Djiboutin ja Eritrean välissä. Raakaöljy ja polttoaineet Persianlahdelta kulkevat tätä kautta kohti Välimerta Suezin kanavan tai Egyptin rannikolla sijaitsevan SUMED-putken kautta, samoin kuin Aasiaan matkalla olevat tuotteet, mukaan lukien venäläinen öljy. Huthit hallitsevat Jemenin väkirikkaimpia alueita ja suurta osaa pohjoisesta, ja asema salmella antaisi heille vaikutusvaltaa tähän liikenteeseen.
Toinen siirto osoittaa, että paine hallituksen puolella on todellinen: hallituksen joukkojen kanssa liittoutunut sotilasjohtaja sanoi torstaina määränneensä länsirannikon ryhmänsä perustamaan vaihtoehtoisen komentokeskuksen turvalliseen paikkaan. Määräys tuli Tarek Salehilta, murhatun presidentti Ali Abdullah Salehin veljenpojalta, jonka kansallisen vastarinnan joukkoja (National Resistance Forces) työnnetään takaisin lännestä.
Sadat naiset ja lapset lähtivät torstaina Mochasta kohti Lahjin ja Adenin maakuntia, jotka ovat Saudi-Arabian tukeman hallituksen hallinnassa, menetettyään sukulaisiaan taisteluissa Jemenin hallituksen tietojen mukaan. Osissa Taizin ja al-Hodeidahin maakuntia taistelut ovat ajaneet yli 20 000 ihmistä kodistaan viimeisten kahden viikon aikana.
Hyökkäykset ovat molemminpuolisia. Saudi-Arabia sanoo huthien tehostaneen hyökkäyksiä kuningaskuntaa vastaan ja että 73 ihmistä, mukaan lukien naisia ja lapsia, loukkaantui hyökkäyksissä siviili- ja talouskohteisiin maan eteläosassa. Huthit puolestaan väittävät, että Saudi-Arabian iskut osuivat Jawfin, Maribin ja Saadan rajamaakuntiin sekä Taiziin etelässä ja al-Hodeidahiin Punaisellamerellä. Saudi-Arabia ei ole vahvistanut näitä iskuja.
Rauhanprosessi ei ole koskaan päässyt maaliin saakka. YK:n välittämä tulitauko vuonna 2022 pysäytti pitkälti vuosia kestäneen sodan, mutta ei tuottanut kestävä ratkaisua. Huthit valloittivat Sanaan vuonna 2014 ja ajoivat hallituksen etelään kohti Adenia. Seuraavana vuonna, 2015, Saudi-Arabia aloitti sotilaallisen interventionsa. Uudet taistelut uhkaavat nyt syöstä Jemenin takaisin täysimittaiseen sotaan.
Hyökkäykset merenkulkua ja Saudi-Arabiaa vastaan jatkuivat tänä vuonna vastauksena Yhdysvaltain sotaan huthien läheistä liittolaista Irania vastaan. Kamppailu Jemenin satamista ja rannikosta oli käynnissä jo kauan ennen Gazan tapahtumia ja ennen Yhdysvaltojen ja Israelin hyökkäyksiä Iraniin helmikuussa.
Hinta tuntuu kaukana Jemenin ulkopuolella. Iran on käytännössä sulkenut Hormuzinsalmen – keskiviikkona sen läpi kulki seitsemän alusta, mikä on puolet 10 päivän keskiarvosta – ja Brent-raakaöljyn hinta on yli 100 dollaria tynnyriltä. Jos myös Bab el-Mandeb saarrettaisiin, Persianlahden öljyntuottajat eristettäisiin tärkeimmiltä merireiteiltään.
https://nykysuomi.com/deepseekin-uusi-budjettimalli-voittaa-huippumallit-useissa-testeissa/
Kiinalainen DeepSeek julkaisi torstaina uuden budjettimallinsa V4.1-Flashin – ja yhtiön omien testien mukaan se peittoaa useita maailman raskaan sarjan tekoälymalleja. Samaan aikaan hintoja leikataan jälleen kehittäjiltä, jotka rakentavat mallia omiin palveluihinsa.
Ensimmäinen asia, jonka käyttäjä huomaa, on mallin kyky nähdä. V4.1-Flash hyväksyy sekä kuvia että tekstiä ja vastaa tekstillä. Tämä tarkoittaa, että se pystyy lukemaan kuitin, kaavion tai näyttökuvan suoraan ilman, että ketjuun tarvitaan erillistä kuvamallia.
Testitulokset ovat vielä hätkähdyttävämpiä. DeepSeek raportoi sarjasta testejä, joissa mallin on tehtävä muutakin kuin vastattava kysymykseen: sen on suoriuduttava monivaiheisesta tehtävästä itsenäisesti etsimällä tiedostoja, ajamalla komentoja ja korjaamalla omat virheensä. Tätä tekoäly-yhtiöt myyvät nykyään "agentteina". Terminal-Bench 2.1 -testissä V4.1-Flash saa 90,6 pistettä, kun taas Anthropicin Opus-5.0 saa 89,1 ja GPT-5.6 Sol 88,8 pistettä.
AutomationBenchissä, joka mittaa mallin kykyä automatisoida työtehtäviä, ero kasvaa: 54,8 pistettä verrattuna Opus-5.0:n 50,3 pisteeseen ja GPT-5.6 Solin 45,8 pisteeseen. Julkaisun koko ydin on siinä, että yhtiön uuden arkkitehtuuriperheen pienimmäksi kutsuma malli voittaa lippulaivamallit.
Avaa julkaisu X:ssä
Luvut ovat peräisin DeepSeekiltä itseltään, ja ne on mitattu mallin päättelyasetuksen ollessa korkeimmalla tasolla – toisin sanoen kalleimmalla kokoonpanolla. Sillä ei myöskään ole ylivoimaista johtoa kaikkialla: vaikeammassa Terminal-Bench 4.0 -testissä V4.1-Flash saavuttaa vain 31,2 pistettä, kun taas Opus-5.0 saa 51,8 pistettä.
Monille ostajille hintalappu on kuitenkin ratkaiseva tekijä. Miljoona syötetokenia (input tokens) maksaa ruuhka-aikojen ulkopuolella 0,15 dollaria ja miljoona tulostokenia (output tokens) 0,60 dollaria yhtiön julkaistun hinnaston mukaan. Tokeni on pienin tekstiin liittyvä yksikkö, jota malli laskee – lyhyt sana, sanan osa tai välimerkki. Nämä ovat listahintoja kehittäjäpalvelulle, jossa muut yritykset liittävät mallin omiin tuotteisiinsa, eivät chatti-tilauksen hintoja.
Suunnittelu on se, mikä tekee hinnanlaskun mahdolliseksi. Malli aktivoi vain pienen osan itsestään kutakin lukemaansa ja kirjoittamaansa tekstinpätkää kohden, ja käynnissä oleviin keskusteluihin käytetty muisti on kutistunut jyrkästi edeltäjäänsä verrattuna. Valmis malli on myös ladattavissa ja ajettavissa käyttäjien omilla laitteistoilla MIT-lisenssillä.
Yhtiö luottaa uutuuteen niin paljon, että se antaa sen korvata oman huippumallinsa: 14. syyskuuta alkaen V4-Pro-kutsuihin vastaa V4.1-Flash Flash-hinnoilla, kunnes V4.1-Pro valmistuu.
Olisikohan koirakammoinen poliisi musu?