Anthropic julkaisi perjantaina Claude Opus 5:n, uusimman version pitkäaikaisesta raskaan sarjan mallistaan. Yhtiön mukaan malli yltää monilla osa-alueilla lähes Claude Fable 5:n tasolle, mutta maksaa puolet vähemmän. Julkaisu on Anthropicin neljäs uusi malli alle kahdessa kuukaudessa.
Ajoitus kertoo paljon markkinan suunnasta. Kilpailu ei ratkea enää pelkällä huippusuorituksella, vaan sillä, mitä älykkyys maksaa päivittäisessä käytössä. Opus 5 asettuu kalliin Fable-tason ja edullisen Sonnet-tason väliin. Se on nyt oletusmalli Claude Max -tilauksessa ja vahvin malli Claude Prossa.
Vertailutestit nostavat Opus 5:n kärkeen
Anthropicin ilmoittamat tulokset ovat poikkeuksellisen selviä. Frontier-Bench v0.1 -testissä, joka mittaa agenttimaista komentorivikoodausta, Opus 5 saa 43,3 prosenttia. Edeltäjä Opus 4.8 ylsi 18,7 prosenttiin ja järeämpi Fable 5 puolestaan 33,7 prosenttiin. Ero edeltäjään on siis yli kaksinkertainen.
ARC-AGI 3 -testi mittaa kykyä ratkoa uudenlaisia ongelmia. Siinä Opus 5 sai Anthropicin mukaan kolminkertaisen pistemäärän seuraavaksi parhaaseen malliin verrattuna. Tietokoneen käyttöä mittaavassa OSWorld 2.0 -testissä malli ohitti Fable 5:n parhaan tuloksen. Kustannus jäi silti reiluun kolmannekseen.
Anthropic korostaa julkaisussaan mallin kykyä tarkistaa oma työnsä. Yhtiön mukaan Opus 5 on selvästi edeltäjäänsä vahvempi iteroimaan sinnikkäästi, kunnes tehtävä on valmis. Esimerkkinä mainitaan tilanne, jossa malli rakensi puutteellisen ohjeen pohjalta oman konenäköputken.
Luvut kannattaa silti lukea kriittisesti, sillä ne tulevat mallin tekijältä. Anthropic myöntää itse, että Opus 5 jää Mythos 5:n taakse kyberturvallisuustehtävissä ja biologian tutkimuksessa. Yhdessä agenttikoodauksen vertailussa kärjessä on yhä OpenAI:n malli. Rehellisyys poikkeaa alan tavanomaisesta superlatiivikielestä.

Hinta ratkaisee päivittäisen käytön
Opus 5 maksaa 5 dollaria miljoonalta syötetokenilta ja 25 dollaria miljoonalta tuotostokenilta. Hinta on täsmälleen sama kuin edeltäjällä Opus 4.8:lla. Suorituskyky nousi, hinta ei.
Anthropic ohjaa viestinnässään huomion tietoisesti suoritukseen suhteessa hintaan. Yhtiön esittämät kaaviot painottavat tulosta annetulla kustannustasolla, eivät pelkkää huippupistemäärää. Se on eri lähestymistapa kuin alalla on totuttu näkemään.
Malliin tuli myös säädettävä effort-asetus eli panostustaso. Sillä käyttäjä voi vaihtaa älykkyyttä nopeuteen ja pienempään tokenikulutukseen. Käytännössä sama malli taipuu sekä raskaaseen analyysiin että kevyeen rutiiniin.
Rinnalla julkaistiin Fast-tila, joka toimii noin 2,5-kertaisella nopeudella. Siitä maksetaan kaksinkertainen perushinta. Nopeus on siis ostettavissa erikseen silloin, kun odottelu maksaa enemmän kuin tokenit.

Kaksi uudistusta agenttikehittäjille
Mallin mukana tuli kaksi beetavaiheen uudistusta ohjelmointirajapintaan. Kumpikaan ei näy vertailutesteissä, mutta molemmat vaikuttavat agenttien arkeen.
Ensimmäinen on työkalujen vaihtaminen kesken keskustelun. Aiemmin työkalulistan muuttaminen mitätöi kehotevälimuistin eli prompt cachen. Nyt kehittäjä voi vaihtaa käytettävissä olevia työkaluja ilman, että välimuisti menee hukkaan. Pitkissä agenttiajoissa säästö on merkittävä.
Toinen uudistus on automaattinen varareititys. Jos turvaluokittelija merkitsee pyynnön, se voidaan ohjata automaattisesti toiselle mallille virheilmoituksen sijaan. Käyttäjä saa toimivan vastauksen keskeytyksen sijasta.
Anthropic arvioi, että luokittelijat aktivoituvat Opus 5:llä noin 85 prosenttia harvemmin kuin Fable 5:llä. Syynä on kevyempi kohtelu, jonka vähemmän kyvykäs malli saa. Rajoituksia on silti jäljellä, erityisesti haavoittuvuuksien etsimisessä binäärikoodista.

Saatavuus laajeni heti julkaisupäivänä
Opus 5 on saatavilla välittömästi kaikilla Anthropicin alustoilla. Kehittäjät tavoittavat sen nimellä claude-opus-5 Claude-rajapinnasta. Lisäksi malli löytyy Amazon Bedrockista, Google Cloudista ja Microsoft Foundrysta.
GitHub otti mallin käyttöön Copilotissa samana päivänä. GitHubin oman muutoslokin mukaan Opus 5 suoriutui varhaisissa testeissä vahvasti agenttimaisissa koodaustehtävissä. Erityisesti kohdennetut muutokset ja oman työn varmistaminen paranivat.
Copilotissa malli näkyy Pro+-, Max-, Business- ja Enterprise-tilaajille. Valittavissa se on muun muassa Visual Studio Codessa, JetBrainsissa, Xcodessa ja Copilot CLI:ssä. Yritysasiakkaiden ylläpitäjien on erikseen sallittava malli asetuksista.
Aiempien Opus-mallien tapaan Opus 5:een ei liity datan säilytysvaatimusta. Se erottaa sen Fable- ja Mythos-malleista, joita koskee 30 päivän säilytyskäytäntö. Tietosuojasta tarkoille asiakkaille ero on käytännössä ratkaiseva.

Yhteenveto
Claude Opus 5 ei ole hyppy tuntemattomaan, vaan tarkasti kohdennettu täydennys Anthropicin mallistoon. Se täyttää aukon kalliin Fablen ja edullisen Sonnetin välissä. Hinta pysyi ennallaan, mutta agenttikoodauksen tulos yli kaksinkertaistui.
Anthropicin tuotejohtaja Dianne Penn tiivisti asetelman Reutersille: Opus 5 kannattaa valita hinta-laatusuhteen vuoksi ja Fable 5 päiväkausia kestäviin, hyvin itsenäisiin projekteihin. Työnjako on selkeä. Enää kevyt Haiku-malli odottaa päivitystä 5-sarjaan.
