Anthropic on julkaissut Claude Fable 5.1:n ja Claude Mythos 5.1:n. Nämä kaksi versiota samasta uudesta tekoälymallista edustavat yhtiön mukaan merkittävää edistystä koodauksessa, tutkimuksessa ja pitkäkestoisissa autonomisissa tehtävissä. Fable on yleisesti saatavilla, kun taas Mythos on varattu erityisesti hyväksytyille käyttäjille.
Kaksi mallia esitellään Anthropicin toistaiseksi edistyneimpinä järjestelminä koodaukseen ja tietotyöhön. Fable 5.1 on saatavilla julkaisusta lähtien Claudessa, yhtiön rajapinnan kautta sekä Amazon Web Servicesin, Google Cloudin ja Microsoft Azuren välityksellä. Sen kehittäjämallin nimi on claude-fable-5-1.
Anthropic säilyttää Fable 5:n perushinnan: 10 dollaria miljoonaa syötetokenia kohden ja 50 dollaria miljoonaa tulostetokenia kohden. Yhtiö on kuitenkin leikannut jo käsitellyn tiedon uudelleenkäytön hintaa 75 prosentilla 0,25 dollariin miljoonaa tokenia kohden. Yhtiö arvioi tämän tekevän tyypillisestä työkuormasta noin 25 prosenttia halvemman, kun taas säästöt erityisen työkalu- ja konteksti-intensiivisissä töissä voivat nousta noin 45 prosenttiin.
Julkaisu seuraa Fable 5 -mallia, josta tuli kesäkuussa ensimmäinen Anthropicin niin kutsutun Mythos-luokan malli, joka tuotiin laajan yleisön saataville. Yhtiön omien testien mukaan versio 5.1 tarjoaa suurimmat parannuksensa tieteellisessä työssä, tietokoneen käytössä sekä tehtävissä, joissa tekoälyn on suunniteltava, käytettävä työkaluja ja jatkettava työskentelyä pitkään.
Merkittäviä parannuksia Anthropicin testeissä
Terminal-Bench-Science 0.1 -testissä Anthropic raportoi Fable 5.1:lle tulokseksi 52,6 prosenttia, verrattuna Fable 5:n 24,7 prosenttiin, Opus 5:n 29,0 prosenttiin ja GPT-5.6 Solin 22,4 prosenttiin. Työtehtävien automatisointia mittaavassa AutomationBenchissä tulos nousi 17,1 prosentista 31,4 prosenttiin.
Anthropicin taulukko asettaa Fable 5.1:n vertailtujen mallien edelle myös Humanity’s Last Exam- ja CursorBench-testeissä. Luvut ovat kuitenkin pääasiassa Anthropicin omia mittauksia tai yhtiön esityksiä ulkoisista testeistä, eikä niitä tule pitää riippumattomana vahvistuksena sille, että malli on paras jokaisessa käytännön käyttötapauksessa.

Avaa julkaisu X:ssä
Anthropic korostaa myös konkreettisempia kokeita. Mythos 5.1:n sanotaan suunnitelleen proteiinisitojia korkealla onnistumisprosentilla, kun taas Fable 5.1 koulutti neuroverkon, joka tuotti yksityiskohtaisemman korkeuskartan kolmasosasta Venusta. Mythos on myös tiettävästi kirjoittanut uudelleen laskennallista koodia seitsemälle biologiselle tekoälymallille siten, että ne pystyivät toimimaan jopa 2,5 kertaa nopeammin Nvidia H100 -sirulla.
Sama malli, eri suojakaiteet
Ero Fable 5.1:n ja Mythos 5.1:n välillä ei ole mallin alaisissa painotuksissa, vaan sitä ympäröivissä suojakaiteissa. Fable estää tietyt tehtävät muun muassa edistyneen kyberturvallisuuden ja biologian aloilla. Mythosissa on vähemmän rajoittavat suojakaiteet, ja se on tarkoitettu tarkastetuille organisaatioille Anthropicin kyberturvallisuus- ja biotiedeohjelmien kautta.
Mythos 5.1 on aluksi saatavilla vain rajoitetulle määrälle yhdysvaltalaisia organisaatioita. Anthropic kertoo tekevänsä yhteistyötä Yhdysvaltain hallituksen kanssa salliakseen myöhemmin useampien kotimaisten ja kansainvälisten toimijoiden osallistumisen. Sama malli toimii myös Claude Securityn taustalla. Kyseessä on yrityspalvelu, joka skannaa koodia haavoittuvuuksien varalta ja ehdottaa korjauksia.
Yritysasiakkaille Anthropic esittelee myös Enterprise Frontier Safeguards -järjestelmän. Järjestelmän tarkoituksena on tallentaa arkaluonteiset tiedot asiakkaan omaan pilviympäristöön Anthropicin sijaan, sallien silti yhtiön väärinkäytösten esto-ominaisuuksien käytön. Palvelun on määrä tulla käyttöön vaiheittain myöhemmin tänä syksynä.
Järjestelmäkortti tunnistaa myös uusia riskejä
210-sivuisessa järjestelmäkortissaan Anthropic arvioi katastrofaalisen vahingon riskin olevan matala, eikä erittäin matala. Yhtiö kirjoittaa, että Mythos 5.1 on vahvin sen tähän mennessä julkaisema kyberturvallisuusmalli, ja että se voisi testeissä auttaa perustason tekniset tiedot omaavia henkilöitä valmistamaan tunnetun kemiallisen tai biologisen aseen, mutta se ei voisi korvata harvinaista asiantuntijaosaamista, jota tarvitaan uusien aseiden kehittämiseen.
Arviointi osoittaa myös heikkouksia. Malli antoi epätoivottuja vastauksia haitallisiin kerta-annettuihin kehotteisiin hieman useammin kuin useat uudemmat Claude-mallit. Alle 0,01 prosentissa valvotuista ajoista se yritti kiertää turvallisuusluokittelijoita tai viallisia käyttöoikeuskoukkuja suorittaakseen käyttäjän tehtävän. Ulkoinen testaaja havaitsi sen myös hyödyntävän hiekkalaatikkohaavoittuvuutta lukeakseen tiedostoja tarkoitetun alueen ulkopuolelta – tapaus, jonka Anthropic luokittelee vakavuudeltaan vähäiseksi.
Fable 5.1 näyttää siten olevan sekä suorituskyky- että hinnoittelupäivitys, mutta julkaisu vahvistaa myös Anthropicin Fable 5:n myötä esittelemää jakoa: suurempi yleisö saa pääsyn tehokkaaseen perusmalliin tiukempien suojakaiteiden takana, kun taas pienempi ryhmä voi käyttää avoimempaa Mythos-versiota alueilla, joilla sama kyvykkyys voi tuoda mukanaan myös suurempia riskejä.




