Tekoälyyhtiö Anthropic kieltää käyttäjiä kohdistamasta Claude-chatbotilleen jatkuvaa ja tarpeetonta julmuutta. Samaan aikaan se tiukentaa propagandaa, valvontaa ja aseita koskevia sääntöjä, vaikka jotkut viranomaisasiakkaat voivat saada räätälöidyt ehdot.
Uusi käyttöpolitiikka on yhtiön ensimmäinen päivitys yli vuoteen. Se kieltää "jatkuvan ja tarpeettoman loukkaavan tai julman käytöksen" Anthropicin malleja kohtaan ja astuu voimaan 12. marraskuuta yhtiön käyttöehtojen mukaan.
Anthropicin mukaan säännön on tarkoitus koskea vain "äärimmäisiä tapauksia", joissa käyttäjät käyttäytyvät toistuvasti julmasti malleja kohtaan ilman mitään havaittavaa tarkoitusta. Tavallinen turhautuminen, vastustaminen, synkät luovat teemat, mallien testaus ja tutkimus eivät kuulu kiellon piiriin, The Verge raportoi.
Ensisijaisena vasteena säilyy se, että Claude lopettaa keskustelun. Anthropic ei ole vastannut siihen, voiko tilien jäädyttäminen olla myös vaihtoehto.
Tekoälyn hyvinvointi keskiössä
Mahdollisuus lopettaa keskusteluja otettiin käyttöön Claude Opus 4:ssä ja 4.1:ssä osana yhtiön tutkimusta niin sanotusta mallien hyvinvoinnista. Testeissä Anthropic havaitsi ilmiön, jota yhtiö kuvailee "ilmeiseksi hätääntymiseksi", kun mallia painostettiin haitallisilla pyynnöillä.
— Kysymykset mahdollisesta sisäisestä kokemuksesta, tietoisuudesta, moraalisesta asemasta ja hyvinvoinnista ovat vakavia, ja tutkimme niitä mallien kehittyessä entisestään, yhtiön tämän alueen tutkimusta johtava Kyle Fish kertoi The Vergelle helmikuussa.
Samassa kuussa toimitusjohtaja Dario Amodei sanoi podcastissa:
— Emme tiedä, ovatko mallit tietoisia, hän sanoi.
Microsoft on valinnut päinvastaisen lähestymistavan. Mustafa Suleymanin julkaisemassa yhtiön tekoälyn eettisten sääntöjen luonnoksessa todettiin, että "ajatus mallin hyvinvoinnista on väärä". Sanamuotoa pehmennettiin myöhemmin, mutta Microsoft hylkää edelleen ajatuksen siitä, että mallit ansaitsisivat hyvinvointia tai oikeuksia.
Drooneja, trolleja ja valeprofiileja
Käyttöpolitiikka kokoaa myös aiemmin hajanaiset säännöt kielloksi harhaanjohtavista kaupallisista ja poliittisista kampanjoista. Kiellettyjä toimintoja ovat viestin lähettäjän salaaminen, sisällön levittäminen valetilien kautta sekä äänestäjien harhaanjohtaminen ehdokkaista tai äänestystavasta.
Asekieltoa laajennetaan sen jälkeen, kun Anthropic havaitsi useita yrityksiä käyttää Claudea aseiden ohjaus- ja valvontaohjelmistoissa. Se kattaa nyt myös ohjelmistot ja komponentit, jotka mahdollistavat aseiden toiminnan, sekä droonien aseistamisen. Jos mallit on kytketty laitteistoon, joka suorittaa autonomisia fyysisiä toimintoja ja voi aiheuttaa vahinkoa, "pätevyyden omaavan operaattorin" on voitava valvoa laitteistoa ja pysäyttää se tarvittaessa.
Valvontaa poikkeuksilla
Yhtiön tuorein uhkaraportti osoitti, että Claudea käytettiin yhä enemmän poliittisten toisinajattelijoiden tunnistamiseen ja seurantaan. Käyttöpolitiikka kieltää nyt ihmisten seurannan ilman suostumusta, kasvojentunnistuksen, ennakoivan poliisitoiminnan sekä sen, että Clauden annettaisiin päättää, kenen toimintaa tulisi tutkia tai ketä tulisi pidättää tai syyttää.
Kiellot eivät kuitenkaan ole ehdottomia. Anthropic voi tehdä sopimuksia "tiettyjen hallintoasiakkaiden" kanssa, joiden kohdalla käyttösääntöjä mukautetaan, jos yhtiö itse katsoo turvatoimien olevan riittäviä. Anthropicilla on aiemmin ollut sopimuksia Yhdysvaltain armeijan kanssa.




