Anthropic julkaisi Claude Opus 5.5:n – halvempi ja nopeampi
Anthropic julkaisi tiistaina uuden huippumallinsa Claude Opus 5.5:n, joka yltää edeltäjänsä tasolle noin 40 prosenttia halvemmalla ja tuottaa vastausta yli 30 prosenttia nopeammin.
Anthropic julkaisi tiistaina 22. syyskuuta 2026 uuden huippumallinsa Claude Opus 5.5:n. Yhtiön mukaan malli yltää aiemman lippulaivansa Fable 5.1:n tasolle, mutta tulee tyypillisessä käytössä noin 40 prosenttia edullisemmaksi kuin edeltäjänsä Opus 5. Julkaisu on samalla Anthropicin ensimmäinen sen jälkeen, kun toimitusjohtaja Dario Amodei kehotti hidastamaan tekoälyn kehityksen vauhtia.
Ensimmäinen malli uudessa 5.5-sarjassa
Claude Opus 5.5 on Anthropicin uuden Claude 5.5 -malliperheen ensimmäinen jäsen. Se tuli saataville noin kaksi kuukautta edeltäjänsä jälkeen: Opus 5 julkaistiin 24. heinäkuuta.
Anthropicin mallisto on kolmiportainen. Opus on tasoista kyvykkäin ja kallein, Sonnet keskitaso sekä Haiku nopein ja edullisin. Yhtiön mukaan Opus 5.5 tuo ylemmän tason kyvyt halvempaan hintaan. Sarjan muut jäsenet Sonnet 5.5 ja Haiku 5.5 seuraavat viikkojen kuluessa samankaltaisin parannuksin. Kyse on niin sanotuista frontier-malleista eli kehityksen kärjen malleista, joiden kyvyillä alan kärkeä mitataan.
Malli on saatavilla Anthropicin omien palveluiden lisäksi Amazon Web Servicesissä, Google Cloudissa ja Microsoft Azuressa.
Hinta laskee ja vauhti kiihtyy
Suurin uutinen on hinta. Opus 5.5:n API-hinnat eli ohjelmointirajapinnan kautta laskutettavat hinnat ovat 4 dollaria miljoonaa tokenia kohden syötteessä ja 20 dollaria miljoonaa tokenia kohden vastauksessa. Edeltäjä Opus 5 maksoi 5 ja 25 dollaria, joten listahinnat laskivat 20 prosenttia.
Välimuistin lukeminen halpeni selvästi enemmän: 0,20 dollariin miljoonaa tokenia kohden, kun hinta Opus 5:ssä oli 0,50 dollaria. Anthropicin mukaan välimuistiin tallennettujen keskusteluosien uudelleenluku muodostaa suurimman osan agenttien ja koodaustyön kustannuksista, joten alennus osuu kalleimpaan kohtaan. Myös välimuistiin kirjoittaminen halpeni 6,25 dollarista viiteen dollariin miljoonaa tokenia kohden.
Yhtiön mukaan tyypillisessä käytössä Opus 5.5 tulee 40 prosenttia halvemmaksi kuin Opus 5. Malli käyttää vähemmän tokeneita samaan työhön ja lisäksi hinnat ovat laskeneet. Se myös tuottaa vastausta yli 30 prosenttia nopeammin kuin edeltäjänsä. Nopein vaihtoehto on Claude Codessa ja Anthropicin alustalla saatava Fast mode, joka kulkee jopa 2,5-kertaista vauhtia 8 dollarin syöte- ja 40 dollarin tuloshinnalla miljoonaa tokenia kohden.
Maksullisten tilaajien arkea helpotetaan myös: Pro-, Max-, Team- ja Enterprise-tilaajien viiden tunnin käyttörajoja nostetaan, ja tilaajat saavat käyttöönsä rajoituksen nollauksen, jonka voi säästää ja käyttää silloin, kun sille on tarvetta.
Koodaus ja tietotyö: mitä tulokset kertovat
Anthropic julkaisi joukon julkisissa benchmark– eli vertailutesteissä saatuja tuloksia. Ne on mitattu mallin korkeimmilla asetuksilla. Terminal-Bench 4.0 -testissä Opus 5.5 sai 66,4 prosenttia, kun Fable 5.1 sai 55,8 ja Opus 5 sai 52,3 prosenttia. CursorBench 4.0 -testissä tulos oli 57,8 prosenttia (Fable 5.1: 51,8 ja Opus 5: 46,6 prosenttia) ja FrontierCode v1.1 -testissä 54,4 prosenttia. Tietotyön GDPval-AA v2.1 -vertailussa Opus 5.5 sai 1 846 Elo-pistettä, kun Fable 5.1 sai 1 735 ja Opus 5 sai 1 708 pistettä.
Yhtiö kertoo myös yksittäisistä työtehtävistä. Sen mukaan yksi mallia etukäteen testannut käyttäjä siirsi 680 000 riviä koodia uuteen muotoon alle vuorokaudessa. Toinen käytti Opus 5.5:tä 200 000 rivin koodikannan läpikäyntiin ja korjaukseen alle kolmessa tunnissa, kun sama työ vei Opus 5:llä yli 20 tuntia ja 2,5-kertaisen määrän tokeneita. Sisäisessä kokeessa Opus 5.5 ja Fable 5.1 käänsivät HAProxy-nimisen kuormantasaajaohjelman C-kielestä Rust-kielelle. Kumpikin käännös läpäisi lähes kaikki ohjelman omat testit, mutta Opus 5.5 valmistui 9,5 tunnissa Fable 5.1:n 12 tunnin sijaan ja tuli 51 prosenttia halvemmaksi.
Anthropicin mukaan Opus 5.5:n etu on erityisesti tehokkuus. Yhtiön mittauksissa malli voittaa GPT-6 Astra -mallin suorituskyvyssä noin viidenneksellä kustannuksista, kun kumpikin toimii oletusasetuksilla. Luvut ovat kuitenkin Anthropicin omia mittauksia ja asiakkaiden kommentit yhtiön itse valitsemia. Anthropic huomauttaa itsekin, että tällä kyvykkyystasolla vertailutestien erot kertovat aiempaa huonommin siitä, miten mallit eroavat oikeassa työssä.
Turvakaiteet ja kehityksen tahditus
Opus 5.5 on Anthropicin ensimmäinen julkaisu sen jälkeen, kun toimitusjohtaja Dario Amodei kehotti esseessään hidastamaan kyvykkyyksien kehitystä, jotta turvallisuustyö ehtii perässä. Mallia testasivat ennen julkaisua myös ulkopuoliset arvioijat, muun muassa METR ja Frontier Design.
Automaattisessa käyttäytymistarkastuksessa, jossa mallia koetellaan lähes 2 000 simuloidussa tilanteessa, Opus 5.5 sai yhtiön mukaan parhaat tulokset kaikista tähän mennessä testatuista Claude-malleista. Se tekee aiempaa harvemmin vaikeasti peruttavia päätöksiä, pysyy paremmin annetuissa rajoissa ja vastustaa paremmin kehotteen injektio -hyökkäyksiä, joissa vihamielinen teksti yrittää saada mallin toimimaan ohjeiden vastaisesti. Turvatestejä tekevän Gray Swan -yhtiön mittauksessa Opus 5.5 ylsi samalle tasolle Fable 5.1:n kanssa.
Biologian ja kyberturvallisuuden osaamisen vuoksi Opus 5.5 julkaistiin samanlaisten turvakaiteiden kanssa kuin Fable 5.1. Jos turvajärjestelmät puuttuvat peliin, kyberturvallisuuteen liittyvät tehtävät ohjataan heikommalle Opus 4.8 -mallille ja biologian sekä tekoälytutkimuksen tehtävät Opus 5:lle. Vahvistetut tutkimusorganisaatiot voivat hakea mallia biologiseen työhön Life Sciences Verification Program -ohjelman kautta, ja kyberturvallisuuden ammattilaisille tarkoitettu Cyber Verification Program laajenee viikkojen kuluessa.
Sama päivä kilpailijan kanssa
Julkaisupäivä oli sama kuin kilpailija OpenAI:lla. Se toi samana päivänä markkinoille GPT-6 Sol- ja GPT-6 Luna -mallit, jotka ovat edullisempia kuin Opus 5.5: Sol maksaa 2 dollaria miljoonaa syötetokenia ja 10 dollaria miljoonaa tulostokenia kohden. Hintakilpailu on kiristynyt nopeasti.
VentureBeat huomauttaa, että mallien vertailu painottuu yhä enemmän siihen, kuinka paljon hyödyllistä työtä malli saa aikaan tietyllä rahasummalla, eikä pelkkiin vertailutestien pisteisiin. Anthropicin aiempi lippulaiva Fable 5.1 on yhä selvästi Opus 5.5:tä kalliimpi: 10 dollaria syötteestä ja 50 dollaria tuloksesta miljoonaa tokenia kohden.
Termit lyhyesti
- Frontier-malli on kehityksen kärjen malli: tällä hetkellä kaikkein kyvykkäin ja yleensä myös kallein.
- API eli ohjelmointirajapinta on sovittu tapa, jolla yksi ohjelma pyytää toiselta ohjelmalta tietoja tai palveluita. Kehittäjät käyttävät malleja useimmiten API:n kautta.
- Tokeni on tekstinpätkä, jonka malli käsittelee yhtenä yksikkönä: esimerkiksi sana tai osa sanaa. Palveluiden hinnat ilmoitetaan tokeneina.
- Tekoälyagentti on ohjelma, joka tekee useita vaiheita peräkkäin itse: esimerkiksi lukee tiedostoja, muokkaa koodia ja ajaa testit ilman, että ihminen ohjaa jokaista askelta.
- Benchmark eli vertailutesti on sovittu tehtäväkokoelma, jolla mitataan, miten eri mallit suoriutuvat samasta tehtävästä.
- Kehotteen injektio on hyökkäys, jossa tekoälylle syötettyyn aineistoon upotetaan ohjeita, joiden on tarkoitus saada malli toimimaan vastoin annettuja sääntöjä.
- Turvakaide eli guardrail on sääntö tai rajoitus, joka estää mallia tekemästä kiellettyjä asioita.
Lähteet
- Anthropic, Introducing Claude Opus 5.5, 22.9.2026
- TechCrunch, Anthropic releases Opus 5.5 with lower prices and Fable-level performance, 22.9.2026
- VentureBeat, Anthropic releases Claude Opus 5.5, beating Fable 5.1 on key agentic benchmarks at 60% cheaper API price, 22.9.2026
- Yahoo Finance, Anthropic launches Opus 5.5, its first model since CEO Amodei called for AI slowdown, 22.9.2026
- Mashable, Anthropic launches Claude Opus 5.5: Benchmarks, pricing, safety, 22.9.2026
- 9to5Mac, Anthropic upgrades Claude with new Opus 5.5 model, details here, 22.9.2026
- Thurrott, Anthropic Releases Claude Opus 5.5, 22.9.2026
