Kiinalainen DeepSeek julkaisi torstaina uuden budjettimallinsa V4.1-Flashin – ja yhtiön omien testien mukaan se peittoaa useita maailman raskaan sarjan tekoälymalleja. Samaan aikaan hintoja leikataan jälleen kehittäjiltä, jotka rakentavat mallia omiin palveluihinsa.
Ensimmäinen asia, jonka käyttäjä huomaa, on mallin kyky nähdä. V4.1-Flash hyväksyy sekä kuvia että tekstiä ja vastaa tekstillä. Tämä tarkoittaa, että se pystyy lukemaan kuitin, kaavion tai näyttökuvan suoraan ilman, että ketjuun tarvitaan erillistä kuvamallia.
Testitulokset ovat vielä hätkähdyttävämpiä. DeepSeek raportoi sarjasta testejä, joissa mallin on tehtävä muutakin kuin vastattava kysymykseen: sen on suoriuduttava monivaiheisesta tehtävästä itsenäisesti etsimällä tiedostoja, ajamalla komentoja ja korjaamalla omat virheensä. Tätä tekoäly-yhtiöt myyvät nykyään "agentteina". Terminal-Bench 2.1 -testissä V4.1-Flash saa 90,6 pistettä, kun taas Anthropicin Opus-5.0 saa 89,1 ja GPT-5.6 Sol 88,8 pistettä.
AutomationBenchissä, joka mittaa mallin kykyä automatisoida työtehtäviä, ero kasvaa: 54,8 pistettä verrattuna Opus-5.0:n 50,3 pisteeseen ja GPT-5.6 Solin 45,8 pisteeseen. Julkaisun koko ydin on siinä, että yhtiön uuden arkkitehtuuriperheen pienimmäksi kutsuma malli voittaa lippulaivamallit.
Avaa julkaisu X:ssä
Luvut ovat peräisin DeepSeekiltä itseltään, ja ne on mitattu mallin päättelyasetuksen ollessa korkeimmalla tasolla – toisin sanoen kalleimmalla kokoonpanolla. Sillä ei myöskään ole ylivoimaista johtoa kaikkialla: vaikeammassa Terminal-Bench 4.0 -testissä V4.1-Flash saavuttaa vain 31,2 pistettä, kun taas Opus-5.0 saa 51,8 pistettä.
Monille ostajille hintalappu on kuitenkin ratkaiseva tekijä. Miljoona syötetokenia (input tokens) maksaa ruuhka-aikojen ulkopuolella 0,15 dollaria ja miljoona tulostokenia (output tokens) 0,60 dollaria yhtiön julkaistun hinnaston mukaan. Tokeni on pienin tekstiin liittyvä yksikkö, jota malli laskee – lyhyt sana, sanan osa tai välimerkki. Nämä ovat listahintoja kehittäjäpalvelulle, jossa muut yritykset liittävät mallin omiin tuotteisiinsa, eivät chatti-tilauksen hintoja.
Suunnittelu on se, mikä tekee hinnanlaskun mahdolliseksi. Malli aktivoi vain pienen osan itsestään kutakin lukemaansa ja kirjoittamaansa tekstinpätkää kohden, ja käynnissä oleviin keskusteluihin käytetty muisti on kutistunut jyrkästi edeltäjäänsä verrattuna. Valmis malli on myös ladattavissa ja ajettavissa käyttäjien omilla laitteistoilla MIT-lisenssillä.
Yhtiö luottaa uutuuteen niin paljon, että se antaa sen korvata oman huippumallinsa: 14. syyskuuta alkaen V4-Pro-kutsuihin vastaa V4.1-Flash Flash-hinnoilla, kunnes V4.1-Pro valmistuu.




