Anthropic julkaisi keskiviikkona Claude Haiku 5.5 -mallin, jota yhtiö kutsuu halvimmaksi, nopeimmaksi ja kyvykkäimmäksi pienimallikseen. Malli on tarkoitettu suuriin volyymeihin ja kustannusherkkiin tehtäviin, kuten tiivistämiseen, luokitteluun ja tietokantakyselyihin.
Hintaero edeltäjään on poikkeuksellisen suuri. Anthropicin julkaisutiedotteen mukaan Haiku 5.5:n ajaminen maksaa keskimäärin noin 75 prosenttia vähemmän kuin Haiku 4.5:n. Samalla yhtiö laski Sonnet 5.5:n hintaa ja lupasi tilaajilleen kuukausittaista API-krediittiä.
Malli on saatavilla heti Claude Platformilla ja kaikissa suurissa pilvipalveluissa. Se kilpailee suoraan OpenAI:n kevyen GPT-6 Lunan kanssa, joka julkaistiin syyskuussa.
Pienimalli, joka kiri isompien rinnalle
Testituloksissa Haiku 5.5 ottaa ison harppauksen edeltäjäänsä nähden. Tietokoneen käyttöä mittaavassa OSWorld 2.1 -testissä se ylsi 72,4 prosenttiin, kun Haiku 4.5 jäi 15,7 prosenttiin. OpenAI:n GPT-6 Luna sai samassa testissä 48,9 prosenttia.
Agenttikoodausta mittaavassa Terminal-Bench 4.0:ssa tulos oli 39,2 prosenttia. Se ylittää GPT-6 Lunan 16,4 prosenttia selvästi, mutta jää kauas Sonnet 5.5:n 70,6 prosentista. Humanity's Last Exam -kokeessa Haiku sai ilman työkaluja 45,9 prosenttia.
Haiku 5.5 on ensimmäinen Haiku-luokan malli, jossa on säädettävä panostustaso. Käyttäjä voi näin valita, painottaako hän kustannuksia vai älykkyyttä. Myös alignment-arvioinneissa malli paransi selvästi Haiku 4.5:n tuloksia.
Asiakkaiden kokemukset ovat samansuuntaisia. Asana mittasi agenttituotteessaan yli 30 prosentin lyhennyksen tehtävien viiveeseen ja jopa 2,5-kertaisen nopeuden agentin vuoroa kohden. HubSpotin CRM-testeissä Haiku 5.5 sai parhaan pienten mallien tuloksen, 92,8 prosenttia.

Hinnoittelu ja 100 000 tokenin raja
Alle 100 000 tokenin kehotteissa syötteen hinta on 0,10 dollaria ja tulosteen 0,50 dollaria miljoonalta tokenilta. Haiku 4.5:een verrattuna hinta on 90 prosenttia alempi. Pidemmissä kehotteissa hinnat ovat viisinkertaiset, mikä tarkoittaa 50 prosentin alennusta edeltäjään.
Anthropic perustelee porrastusta käyttödatalla. Noin 90 prosenttia edellisen Haiku-mallin pyynnöistä mahtui 100 000 tokenin rajan alle. Valtaosa käytöstä halpenee siis kymmenesosaan.
Asiakkaiden testit tukevat lukuja. AlphaSense ajaa noin kahdeksan miljoonaa dokumenttikyselyä viikossa, ja Haiku 5.5 paransi sen tarkkuutta tilastollisesti merkitsevästi. Box mittasi 11 pisteen parannuksen noin puolella viiveellä.
Hintataso muuttaa sitä, millaisia tehtäviä kielimallille kannattaa antaa. Luokittelu, tiivistäminen ja dokumenttien poiminta suurissa erissä ovat olleet monelle yritykselle liian kalliita isommilla malleilla. Kymmenesosan hinnalla sama työ mahtuu useampaan budjettiin.

Alihankkija koodausagenteille
Anthropic markkinoi Haikua erityisesti Opus 5.5:n ja Sonnet 5.5:n apulaiseksi koodaustyössä. Isompi malli hoitaa suunnittelun, ja Haiku ajaa rajatut alitehtävät, kuten tiedostojen läpikäynnin, tiivistämisen ja kontekstin kompaktoinnin.
Cognition lisäsi mallin Devin Fusionin apumalleihin. Kun pääagenttina toimii Opus 5.5 ja apulaisena Haiku 5.5, Fusion säilyttää yhtiön mukaan 66,2 pisteen FrontierCode-tuloksen ja leikkaa samalla kustannuksia ja viivettä.
Kehittäjille Anthropic päivitti Python- ja TypeScript-SDK:t tukemaan tietokoneen ja selaimen käyttöä beetana. Haiku sopii näihin tehtäviin nopeutensa ja hintansa vuoksi. Monimutkaisiin agenttikoodaustehtäviin yhtiö suosittelee yhä isompia malleja.
Työnjako näkyy myös rahoitusanalyysia tekevän Rogon esimerkissä. Kun isompi malli rakentaa esitystä, Haiku-apulainen hakee vuosikertomuksesta tarvittavan liikevaihtorivin. Yhtiön mukaan malli on riittävän tarkka tähän ja niin halpa, että sitä voi ajaa usein.

Sonnet 5.5 halpenee ja tilaajat saavat krediittejä
Haikun rinnalla Anthropic puolitti Sonnet 5.5:n välimuistilukujen hinnan 0,20 dollarista 0,10 dollariin miljoonalta tokenilta. Koska välimuistiluvut muodostavat suuren osan agenttien tokenikulutuksesta, Sonnet 5.5 halpenee useimmissa agenttitehtävissä noin 20 prosenttia.
Lisäksi Max- ja Team-tilaajat saavat tällä viikolla kuukausittaisen krediitin Claude Platformin API-käyttöön. Max 5x -tilaajat saavat 100 dollaria, Max 20x -tilaajat 200 dollaria ja Team-tilaajat enintään 500 dollaria käyttäjien kesken jaettuna.
Haiku 5.5 on saatavilla heti kaikilla alustoilla, myös Amazon Web Servicesissä, Google Cloudissa ja Microsoft Azuressa. Mallin tunniste on claude-haiku-5-5.
Turvallisuusrajoitukset ovat Haiku 4.5:tä tiukemmat mutta väljemmät kuin muissa tuoreissa malleissa. Puolustavat kyberturvatehtävät sallitaan laajemmin kuin Sonnet 5.5:ssä, mutta tunkeutumistestaus ja muut hyökkääjille sopivat tekniikat on estetty.

Yhteenveto
Claude Haiku 5.5 laskee pienten Claude-mallien hintatasoa rajusti ja nostaa samalla suorituskykyä lähes kaikissa mitatuissa testeissä. Se ei korvaa Sonnetia tai Opusta vaativassa koodauksessa, mutta tekee aiemmin liian kalliista massatehtävistä taloudellisesti järkeviä.
Kehittäjille olennaisinta on työnjako: Opus tai Sonnet suunnittelee ja Haiku hoitaa toistuvat alitehtävät. Säädettävä panostustaso ja uudet tietokoneen käytön SDK-työkalut tekevät mallista käyttökelpoisen myös selain- ja asiakaspalveluagenteissa, joissa nopeus ratkaisee.
Yhdessä Sonnet 5.5:n hinnanalennuksen kanssa julkaisu kertoo Anthropicin kilpailevan nyt yhä selvemmin hinnalla OpenAI:n GPT-6 Lunaa vastaan.
