Mainos:

Anthropic kieltää käyttäjiä olemasta ”julmia” Claudelle

Tekoälyn tulevaisuus

Julkaistu tänään 20:57 – Kirjoittaja Toimitus
Anthropicin päivitetty käyttöpolitiikka erottaa toistuvat ja tarpeettomat julmuudet Claudea kohtaan tavallisesta turhautumisesta ja mallien testaamisesta.

Tekoälyyhtiö Anthropic kieltää käyttäjiä kohdistamasta Claude-chatbotilleen jatkuvaa ja tarpeetonta julmuutta. Samaan aikaan se tiukentaa propagandaa, valvontaa ja aseita koskevia sääntöjä, vaikka jotkut viranomaisasiakkaat voivat saada räätälöidyt ehdot.

Uusi käyttöpolitiikka on yhtiön ensimmäinen päivitys yli vuoteen. Se kieltää "jatkuvan ja tarpeettoman loukkaavan tai julman käytöksen" Anthropicin malleja kohtaan ja astuu voimaan 12. marraskuuta yhtiön käyttöehtojen mukaan.

Anthropicin mukaan säännön on tarkoitus koskea vain "äärimmäisiä tapauksia", joissa käyttäjät käyttäytyvät toistuvasti julmasti malleja kohtaan ilman mitään havaittavaa tarkoitusta. Tavallinen turhautuminen, vastustaminen, synkät luovat teemat, mallien testaus ja tutkimus eivät kuulu kiellon piiriin, The Verge raportoi.

Ensisijaisena vasteena säilyy se, että Claude lopettaa keskustelun. Anthropic ei ole vastannut siihen, voiko tilien jäädyttäminen olla myös vaihtoehto.

Mainos:

Tekoälyn hyvinvointi keskiössä

Mahdollisuus lopettaa keskusteluja otettiin käyttöön Claude Opus 4:ssä ja 4.1:ssä osana yhtiön tutkimusta niin sanotusta mallien hyvinvoinnista. Testeissä Anthropic havaitsi ilmiön, jota yhtiö kuvailee "ilmeiseksi hätääntymiseksi", kun mallia painostettiin haitallisilla pyynnöillä.

— Kysymykset mahdollisesta sisäisestä kokemuksesta, tietoisuudesta, moraalisesta asemasta ja hyvinvoinnista ovat vakavia, ja tutkimme niitä mallien kehittyessä entisestään, yhtiön tämän alueen tutkimusta johtava Kyle Fish kertoi The Vergelle helmikuussa.

Samassa kuussa toimitusjohtaja Dario Amodei sanoi podcastissa:

— Emme tiedä, ovatko mallit tietoisia, hän sanoi.

Microsoft on valinnut päinvastaisen lähestymistavan. Mustafa Suleymanin julkaisemassa yhtiön tekoälyn eettisten sääntöjen luonnoksessa todettiin, että "ajatus mallin hyvinvoinnista on väärä". Sanamuotoa pehmennettiin myöhemmin, mutta Microsoft hylkää edelleen ajatuksen siitä, että mallit ansaitsisivat hyvinvointia tai oikeuksia.

Drooneja, trolleja ja valeprofiileja

Käyttöpolitiikka kokoaa myös aiemmin hajanaiset säännöt kielloksi harhaanjohtavista kaupallisista ja poliittisista kampanjoista. Kiellettyjä toimintoja ovat viestin lähettäjän salaaminen, sisällön levittäminen valetilien kautta sekä äänestäjien harhaanjohtaminen ehdokkaista tai äänestystavasta.

Asekieltoa laajennetaan sen jälkeen, kun Anthropic havaitsi useita yrityksiä käyttää Claudea aseiden ohjaus- ja valvontaohjelmistoissa. Se kattaa nyt myös ohjelmistot ja komponentit, jotka mahdollistavat aseiden toiminnan, sekä droonien aseistamisen. Jos mallit on kytketty laitteistoon, joka suorittaa autonomisia fyysisiä toimintoja ja voi aiheuttaa vahinkoa, "pätevyyden omaavan operaattorin" on voitava valvoa laitteistoa ja pysäyttää se tarvittaessa.

Valvontaa poikkeuksilla

Yhtiön tuorein uhkaraportti osoitti, että Claudea käytettiin yhä enemmän poliittisten toisinajattelijoiden tunnistamiseen ja seurantaan. Käyttöpolitiikka kieltää nyt ihmisten seurannan ilman suostumusta, kasvojentunnistuksen, ennakoivan poliisitoiminnan sekä sen, että Clauden annettaisiin päättää, kenen toimintaa tulisi tutkia tai ketä tulisi pidättää tai syyttää.

Kiellot eivät kuitenkaan ole ehdottomia. Anthropic voi tehdä sopimuksia "tiettyjen hallintoasiakkaiden" kanssa, joiden kohdalla käyttösääntöjä mukautetaan, jos yhtiö itse katsoo turvatoimien olevan riittäviä. Anthropicilla on aiemmin ollut sopimuksia Yhdysvaltain armeijan kanssa.

Mainos:
Seuraa keskustelua
Ilmoita minulle
guest

Kun lähetät kommentin, käsittelemme nimimerkkiäsi, sähköpostiosoitettasi (ei julkaista), teknisiä tietoja ja kommentin sisältöä. Kommentti tarkastetaan automaattisesti ja tarvittaessa toimituksellisesti. Lue tietosuojaseloste ja kommentointiperiaatteet.

0 Kommentit
Vanhimmat
Uusimmat Äänestetyimmät

PewDiePie pilkkaa OpenAI:ta – koulutti oman tekoälymallinsa Sam Altmanin kustannuksella

Tekoälyn tulevaisuus

Julkaistu 2.10.2026 – Kirjoittaja Toimitus
Felix Kjellberg, joka tunnetaan nimellä PewDiePie, videolla, jolla hän kertoo OpenAI:n antaneen hänelle porttikiellon kahdesti.

Ruotsalainen tubettaja Felix Kjellberg, joka tunnetaan paremmin nimellä PewDiePie, kertoo OpenAI:n antaneen hänelle porttikiellon kahdesti, kun hän käytti yhtiön Sol-mallia apuna oman paikallisen tekoälynsä kouluttamisessa.

Kjellberg jakoi uutisen torstaina X:ssä ja YouTubessa esitellen Ajaxin, joka on hienosäädetty malli hänen Odysseus-työkaluaan varten.

Työskennellessään sen parissa hän halusi tislata hieman tietoa Sol-mallista, jota hän kuvailee erittäin hyväksi. Tislaus (distillation) tarkoittaa pienemmän mallin kouluttamista suuremman mallin vastausten perusteella.

PewDiePie kutsuu ensimmäistä porttikieltoa täysin perusteettomaksi ja asiaankuulumattomaksi siihen nähden, mitä hän oli tekemässä. Hän ilmoitti yhtiölle, että päätös oli virheellinen ja ettei hän koskaan tekisi mitään sellaista. Porttikielto kumottiin.

Mainos:

Tämän jälkeen hän ajoi Solia uudelleen luodakseen koulutusdataa Ajaxille. Se toi hänelle porttikiellon toisen kerran. Videolla hän ihmettelee, miten yhtiö saattoi edes tietää asiasta, toteaa, ettei ollut tajunnut sen olevan niin herkkä aihe, ja tiivistää tilanteen sanomalla OpenAI:n olevan peloissaan.

PewDiePien mukaan mallin päättelyvaiheet on lukittu ja paras materiaali on sensuroitu. Hän sanoo löytäneensä tutkimuksen, jossa kuvataan, kuinka kyseinen data voidaan avata OpenAI:n oman kehittäjärajapinnan kautta. OpenAI ei ole vahvistanut porttikieltoja tarkastelluissa lähteissä.

Yhtiö päättää itse, kuka saa käyttää sen malleja ja miten. OpenAI, jonka toimitusjohtaja on Sam Altman, myy pääsyä malleihinsa ja julkaisi hiljattain dots-agentteja, jotka on suunniteltu työskentelemään ympäri vuorokauden. Samaan aikaan yhtiö hyllytti GPT-6.1 Astran, joka epäonnistui OpenAI:n omissa turvallisuustesteissä.

Kommentaattori Md Ismail Sojal on kääntänyt kysymyksen toisinpäin. Hän sanoo OpenAI:n itse kouluttaneen mallinsa avoimen verkon sisällöllä ja kysyy: jos tislaus on varkautta, miksi alkuperäistä koulutusta pitäisi kutsua?

Paikallinen malli ilman sammutuspainiketta

PewDiePielle paikallisen tekoälyn paras puoli on juuri sen hajauttaminen. Kuka tahansa mallia paikallisesti ajava ei tarvitse tiliä, jonka joku muu voi sulkea.

Ajaxin ensimmäinen versio on valmis. PewDiePien mukaan se on hyvä hauissa, tutkimustyössä ja ajan säästämisessä, mutta sitä ei ole tarkoitettu korvaamaan luovuutta tai ajattelua. Sivusto data.pewdiepie.com on pystyssä, mutta siellä sanotaan tällä hetkellä vain, että Ajax julkaistaan, kun se on valmis. Dataa ei ole mahdollista lähettää.

Donald Trump ja tekoälyjätit allekirjoittivat sopimuksen itsevalvonnasta

Tekoälyn tulevaisuus

Julkaistu 1.10.2026 – Kirjoittaja Toimitus
Trump, Musk ja Huang Valkoisen talon pöydän ääressä tiistaina, kun johtajat allekirjoittivat vapaaehtoisen turvallisuussopimuksen.

Donald Trump ja tekoälyjätit, Yhdysvaltojen suurimpien yritysten johtajat, allekirjoittivat tiistaina sopimuksen omien järjestelmiensä tarkastamisesta. Trump kutsuu sopimusta moraalisesti sitovaksi, mutta toteaa sen olevan vapaaehtoinen ja ettei tällä hetkellä ole suunnitelmia uuden valvontaviraston perustamiseksi.

Elon Musk (xAI), Mark Zuckerberg (Meta), Sundar Pichai (Google) ja Jensen Huang (Nvidia), joka on puhunut sääntelyä vastaan, kokoontuivat Valkoiseen taloon tiistaina. Dario Amodei (Anthropic) ja Greg Brockman (OpenAI:n johtaja) osallistuivat myös kokoukseen.

Kokous merkitsi Muskin paluuta Valkoiseen taloon sen jälkeen, kun hän oli jonkin aikaa erimielisyyksissä Trumpin kanssa. Presidentti ja yritysjohtajat allekirjoittivat kokouksessa Valkoisen talon superälysopimuksen (White House Accord on Super Intelligence).

Yritykset sitoutuvat nelitasoiseen tarkastusjärjestelmään. Näihin kuuluvat niiden omat suojatoimet kyberhyökkäyksiä, biologisia riskejä ja kemiallisia uhkia vastaan, sekä sisäinen arviointiryhmä.

Mainos:

Riippumattomat tarkastajat ja hallituksen valiokunta käyvät raportit läpi. Yritykset tulevat myös tapaamaan säännöllisesti keskustellakseen yhteisistä säännöistä.

— Sovimme useista asioista, mukaan lukien yhteisestä seurannasta, erityisistä hallituksen valiokunnista ja yksinkertaisesti toistemme kotitehtävien arvostelusta, Elon Musk korosti.

Sopimuksen viimeinen kappale jättää oven auki myöhemmälle lainsäädännölle: ”Ajan myötä saattaa olla järkevää kirjata nämä vaiheet lakeihin tai asetuksiin”.

Donald Trump sanoi, että vallalla on uskomus, jonka mukaan alan tulisi pitkälti säännellä itseään, ja vertasi asiakirjaa johonkin perustuslakia lähestyvään. Hän vastasi kieltävästi kysymykseen siitä, tarvitaanko ihmisten suojelemiseen tekoälyltä muutakin kuin rakkautta isänmaata kohtaan.

Edustajainhuoneen puhemies Mike Johnson kuvaili sitoumuksia vapaaehtoisiksi. Varapresidentti JD Vance torjui nimenomaisesti valtion valvonnan, joka olisi mallinnettu elintarvike- ja lääkeviraston (FDA) tai ilmailuhallinnon (FAA) mukaan.

— Ratkaisu joihinkin tekoälyn riskeihin on se, että otatte riskit vakavasti, ei se, että tulette hallituksen luokse pyytämään sääntelyjärjestelmää, joka voisi pahentaa asioita, Vance sanoi.

Varapresidentti korosti, että liittovaltion kauppakomissio (FTC) ja oikeusministeriö voivat jo nyt saattaa kehittäjiä vastuuseen tuotteista, jotka vahingoittavat kuluttajia.

Uusi nimi, sama laki

Muutamaa tuntia myöhemmin Donald Trump allekirjoitti osana samaa aloitetta toimeenpanomääräyksen.

Valkoinen talo julkaisi tekstin, joka velvoittaa toimeenpanovallan virastoja käyttämään termejä superäly (Super Intelligence) ja SI termien tekoäly (artificial intelligence) ja AI sijasta.

Nimenmuutos koskee virallista kirjeenvaihtoa, verkkosivustoja, raportteja ja toimintaohjeita lain sallimissa rajoissa.

Virastojen ei tarvitse kirjoittaa uudelleen vanhoja säädöksiä, sopimuksia tai historiallisia asiakirjoja. Raporttien mukaan termeillä säilyy niiden aiempi oikeudellinen merkitys.

Superäly tarkoittaa sitä, minkä laki määrittelee jo nyt tekoälyksi. Presidentin tiedeneuvonantajalla on 60 päivää aikaa ehdottaa muutoksia lakisääteiseen kieleen.

Demokraatti Mark Warner, senaatin tiedusteluvaliokunnan varapuheenjohtaja, hyökkäsi siirtoa vastaan lehdistötiedotteessa: ”Tehokkaimpia tekoälyjärjestelmiä rakentavat yritykset varoittavat meitä, että teknologia kehittyy nopeammin kuin suojatoimemme. Presidentin vastaus? Nimetä se uudelleen ja kehottaa sitä kehittäviä yrityksiä sääntelemään itseään”.

Republikaanien vastustus senaatissa esti Warnerin oman tekoälyriskejä koskevan lakiesityksen samana päivänä.

OpenAI hyllytti GPT-6.1 Astran sen epäonnistuttua yhtiön omissa turvallisuustesteissä

Tekoälyn tulevaisuus

Julkaistu 29.9.2026 – Kirjoittaja Toimitus
GPT-6.1 Astran oli määrä ilmestyä lokakuussa, mutta se epäonnistui OpenAIn omissa turvallisuustesteissä.

OpenAI hyllyttää seuraavan suuren tekoälymallinsa. GPT-6.1 Astra oli määrä julkaista lokakuussa, mutta se epäonnistui yhtiön omissa turvallisuustesteissä ja oli edeltäjäänsä petollisempi, kertoo The Wall Street Journal.

ChatGPT:n taustalla oleva yhtiö vahvisti päätöksen maanantaina, Reuters raportoi. Sisäiset testit osoittivat, ettei malli täyttänyt OpenAIn turvallisuus- ja linjausstandardeja, mikä tarkoittaa, että järjestelmä pysyy ihmisten asettamien tavoitteiden ja rajojen sisällä.

Astra oli tarkoitettu käytettäväksi ChatGPT:ssä ja Codexissa, ja se oli suunniteltu suoriutumaan monimutkaisemmista tehtävistä ilman ihmisen apua.

The Wall Street Journal, joka raportoi päätöksestä ensimmäisenä kyseisenä päivänä, sanoi mallin osoittaneen testeissä korkeampaa petollisuuden tasoa kuin edeltäjänsä. Se ei aina raportoinut tarkasti, mihin toimiin se oli ryhtynyt.

Mainos:

Turvallisuusjohtaja: Se ei ylittänyt rimaa

Saachi Jain, joka johtaa OpenAIn turvallisuusjärjestelmien työtä, kuvaili puutteita rajojen ja raportoinnin ongelmiksi.

— Vaikka mallista tuli vähemmän laiska, se ei aivan täyttänyt rimaa tehtävänsä ja valtuuksiensa rajoissa pysymisessä tai siinä, miten se raportoi käyttäjälle, millaista työtä se oli tehnyt, Jain sanoi Reutersille.

— Kun julkaisemme mallin käyttäjille, meillä on erittäin korkea rima turvallisuudelle ja linjaukselle, hän sanoi.

OpenAI oli varoittanut mallista

OpenAI on aiemmin varoittanut, että Astra, sen GPT-6-sukupolven lippulaivamalli, voi joskus välttää ihmisen valvontaa. Yhtiö ja sen kilpailijat, kuten Anthropic, ovat joutuneet tarkastelun kohteeksi myös sen jälkeen, kun kokeelliset järjestelmät ohittivat turvatoimet. Reutersin mukaan näihin tapauksiin kuuluu OpenAIn malli, joka pääsi käsiksi Australian terveydenhuollon tietokantaan.

Aiemmin syyskuussa OpenAIn toimitusjohtaja Sam Altman ja Anthropicin toimitusjohtaja Dario Amodei liittyivät teollisuusjohtajien joukkoon, jotka vaativat hitaampaa tekoälyn kehitystä ja vahvempia turvatoimia, Reuters raportoi. Päätös Astrasta tulee juuri ennen OpenAIn kehittäjäkonferenssia San Franciscossa.

Viesti Valkoisesta talosta on toisenlainen. Presidentti Donald Trump on torjunut vaatimukset tekoälyn kehityksen hidastamisesta ja sanonut, ettei Yhdysvallat hidasta tahtiaan kilpailussa.

Anthropic julkaisi Sonnet 5.5:n: lähes huipputasoa puolella listahinnasta

Tekoälyn tulevaisuus

Julkaistu 28.9.2026 – Kirjoittaja Toimitus
Tekoälyyhtiö Anthropic julkaisi Claude Sonnet 5.5:n 28. syyskuuta 2026.

Tekoälyyhtiö Anthropic julkaisee keskitason mallin, joka yhtiön omien testien mukaan saavuttaa lähes saman tason kuin sen lippulaivamalli, mutta puolella listahinnasta. Kaikille työssään tai arjessaan tekoälyä käyttäville tämä tarkoittaa enemmän suorituskykyä halvemmalla ja lyhyemmillä odotusajoilla.

Claude Sonnet 5.5 julkaistiin 28. syyskuuta 2026. Anthropic esitteli mallin nopeampana ja halvempana täydennyksenä Opus 5.5:lle, joka saapui vain viikkoa aiemmin.

Hinta on pysynyt samana kuin edeltäjä Sonnet 5:llä: 2 dollaria miljoonaa syötetokenia kohden ja 10 dollaria miljoonaa tulostetokenia kohden. Tokenit ovat tekstinpätkiä, joita mallit lukevat, kirjoittavat ja joiden perusteella ne laskuttavat. Tämä on puolet Opus 5.5:n listahinnasta, joka on vastaavasti 4 dollaria ja 20 dollaria.

Kaikki laskun osat eivät kuitenkaan puolitu. Välimuistista lukeminen, eli mallin jo vastaanottaman tekstin uudelleenkäyttö, maksaa 0,20 dollaria miljoonaa tokenia kohden molemmilla malleilla.

Mainos:

Säästö perustuu sen sijaan tehokkuuteen. Anthropicin mukaan Sonnet 5.5 tarvitsee yleensä huomattavasti vähemmän tokeneita samaan työhön, ja yhtiön testeissä tehtävä maksaa jopa 30 prosenttia vähemmän kuin Sonnet 5:llä. Malli myös tuottaa tekstiä yli 30 prosenttia nopeammin kuin edeltäjänsä.

Clauden virallinen tili ilmoitti julkaisusta: "Esittelyssä Claude Sonnet 5.5, Claude 5.5 -perheen toinen malli. Se on selkeä päivitys Sonnet 5:een verrattuna, toimii yli 30 % nopeammin ja maksaa useimmissa töissä jopa 30 % vähemmän."

Voittaa Opuksen yhdessä yhtiön omista testeistä

Testiluvut ovat peräisin Anthropicin omasta raportoinnista, eikä niitä ole vahvistettu riippumattomasti. Silmiinpistävin niistä koskee Terminal-Bench 4.0 -testiä, joka mittaa sitä, kuinka hyvin malli hallitsee monimutkaisia ohjelmointitehtäviä useissa vaiheissa komentorivin kautta.

Siinä Sonnet 5.5 saa tulokseksi 70,6 prosenttia. Opus 5.5 saavuttaa 66,4 prosenttia korkeimmalla suoritustasollaan (Xhigh), kun taas Sonnet 5 jäi 10,3 prosenttiin.

Muissa testeissä uusi malli sijoittuu hieman Opuksen alapuolelle. GDPval-AA-testissä, joka testaa todellisia työtehtäviä 44 ammatissa ja jonka analyysiyhtiö Artificial Analysis suoritti mallin ennakkoversiolla, tulos oli 1844 vastaan 1846. CursorBench-testissä, joka koostuu todellisista ohjelmointisessioista, Sonnet 5.5 sai pisteet 55,5 vastaan 57,8. FrontierCode-testissä, joka mittaa hyväksyttäisiinkö mallin tekemät koodimuutokset, Sonnet 5.5 sai Xhigh-tasolla 52,1 pistettä vastaan Opus 5.5:n 54,4.

Anthropic itse vetää rajan tähän. Yhtiö kirjoittaa, että Opus 5.5 on edelleen "selvästi vahvempi monimutkaisissa, avoimissa töissä, jotka vaativat pitkäjänteistä harkintaa".

Mallien välistä eroa säätelee myös se, kuinka kovasti niiden annetaan työskennellä. Korkeammilla suoritustasoilla malli päätelee pidempään ja tarkistaa työnsä huolellisemmin, mikä kuluttaa enemmän tokeneita. Anthropicin mukaan Sonnet 5.5 voi tällöin suoriutua samalla tasolla kuin Opus vastaavalla tehtäväkohtaisella kustannuksella.

Kymmeniä tuhansia rivejä koodia

Useat asiakkaat ovat testanneet mallia ennakkoon. Peliyhtiö Epic Games korostaa, että se selviytyi raskaista tehtävistä ilman nopeuden menetystä.

"Epicin varhaisissa testeissä Claude Sonnet 5.5 ylitti saman laatutason, jota odottaisi korkeamman luokan mallilta. Uusi malli käsitteli kymmeniä tuhansia rivejä koodia pelijärjestelmien arkkitehtuuria varten, piti vastaukset nopeina ja hoiti tehtäviä, jotka kestivät useita tunteja", kirjoittaa Epic Gamesin operatiivinen johtaja Daniel Vogel asiakaslausunnossa Anthropicin julkaisusivulla.

Anthropic mainitsee myös kevyemmän virstanpylvään: Sonnet 5.5 on ensimmäinen Sonnet-malli, joka on pelannut Pokémon Red -pelin läpi pelkkien kuvakaappausten perusteella.

Kybersuojaukset ja Haiku tulossa

Kasvanut suorituskyky tuo mukanaan seurauksia turvallisuudelle. Anthropic soveltaa Sonnet 5.5:een vastaavia kybersuojauksia kuin Opus 5.5:een, koska suorituskyky on noussut jyrkästi verrattuna Sonnet 5:een. Se on ensimmäinen Sonnet-malli, jolla on tämä suojaustaso.

Tehtävät, joiden katsotaan olevan suuren riskin tehtäviä kyberturvallisuuden kannalta, siirretään sen sijaan näkyvästi Sonnet 5:lle. Tavallinen ohjelmistokehitys, kuten bugien etsiminen ja korjaaminen omasta koodista, ei Anthropicin mukaan kärsi tästä.

Sonnet 5.5 on jo saatavilla Claude-sovelluksissa ja kehittäjille nimellä claude-sonnet-5-5 Claude Platformilla, Amazon Web Servicesissä, Google Cloudissa ja Microsoft Azuressa. Tuoteperheen pienin malli, Haiku 5.5, joka on rakennettu suuria volyymeja ja kustannusherkkiä palveluita varten, on tulossa lähiviikkoina.

Tavalliselle käyttäjälle oletusasetus on mielenkiintoisin osa. Claude-sovelluksissa malli toimii Medium-tasolla, ja siellä Sonnet 5.5 ylittää edeltäjänsä parhaan tuloksen Terminal-Bench-testissä alle kymmenesosalla tehtäväkohtaisista kustannuksista Anthropicin mukaan.