
Claude Haiku 5.5 maksaa neljänneksen edeltäjänsä hinnasta
Claude Haiku 5.5 on Anthropicin nopein ja halvin malli. Se maksaa keskimäärin 75 % vähemmän kuin Haiku 4.5 ja sopii koodausagenttien apulaiseksi.
// Kategoria

Claude Haiku 5.5 on Anthropicin nopein ja halvin malli. Se maksaa keskimäärin 75 % vähemmän kuin Haiku 4.5 ja sopii koodausagenttien apulaiseksi.

Reflectionin ensimmäinen avoin malli Beam tähtää koodaukseen ja agentteihin. Se pärjää kilpailijoille selvästi pienemmällä laskennalla.

Google keskeytti avoimen koodin haavoittuvuuspalkkiot, koska tekoälyn tuottamat virheelliset ilmoitukset tukkivat ohjelman. Päivitys luvataan alkuvuonna.

Pi-koodausagentti sai Codemoden, virtuaalimallit ja välimuistin lämmityksen. Rinnalle tuli kokeellinen Pi Durable pitkäkestoisille agenteille.

Gemini 4 Argon tuottaa miljoona tokenia kerralla ja johtaa koodaustestejä. Aluksi sitä pääsevät käyttämään vain kyberpuolustajat.

Pitkäkestoiset agenttiajot halpenevat: OpenAI julkaisi GPT-6.1 Solin, joka yltää lähes Astran tasolle. Samalla GPT-6.1 Astra jäi hyllylle.

Anthropicin uusi keskitason malli on edeltäjäänsä nopeampi ja halvempi. Agenttikoodauksessa Sonnet 5.5 ohittaa yhtiön testeissä jopa Opus 5.5:n.

Cursor julkaisi Rollouts- ja Security Review -botit. Toinen seuraa muutosta tuotantoon asti, toinen etsii hyödynnettävät virheet jokaisesta PR:stä.

JetBrains kokosi agenttityökalunsa Air-järjestelmäksi: editori, tiimityö ja hallinta samaan pakettiin. ACP-protokolla avaa oven myös muiden agenteille.

OpenAI:n GPT-6 Sol ja Luna maksavat puolet edeltäjistään. Tosiasiavirheet vähenivät, mutta riippumaton mittaus löysi takapakkia tietotyössä.

Anthropicin Claude Opus 5.5 yltää Fable 5.1:n tasolle ja maksaa tyypillisessä työssä 40 prosenttia vähemmän kuin Opus 5. Välimuisti halpeni 60 prosenttia.

Linearin testijoukot nelinkertaistuivat vuodessa, mutta pull requestin odotusaika lyheni. Konetunnit testiä kohden putosivat noin puoleen.

SpaceXAI julkaisi Grok Voice Transcribe 2.0:n. Yhtiön mukaan tarkkuus kaksinkertaistui, mutta hinta pysyi 0,10 dollarissa äänitunnilta.

TypeSafe AI:n Jev ja Cuan CUA-S1-Forms palauttavat todennäköisyyksiä tekstin sijaan. Vercel mittasi 5-18 kertaa nopeamman luokittelun.

Anthropic julkaisi Claude Code Projectsin, jossa koordinaattori jakaa tavoitteen rinnakkaisiin säikeisiin. Säikeet jakavat yhteisen projektimuistin.

Zed avasi Delta-ympäristön julkiseen beetaan. Yhtiö kytki pull requestit pois omasta repositoriostaan ja vei päähaaraan 570 muutosta ilman niitä.

Google toi Gemini 3.8 Liven ja Extended Thinking -version kehittäjille. Malli suorittaa työkalukutsuja taustalla ja jatkaa keskustelua samaan aikaan.

Bolt.new julkaisi Forge-agentin, joka käyttää pelkkiä avoimia malleja. Vastineeksi 50-kertaisesta käyttörajasta istunnot päätyvät mallien koulutukseen.

Specific Labsin Real-SWE ajaa koodausagentit lisensoiduilla tuotantokoodikannoilla. Paras tulos jäi 38,8 prosenttiin ratkaistuista tehtävistä.

Cursorin Projects antaa koordinaattoriagentille kuukausien muistin. Se seuraa Slackia ja pull requesteja ja käynnistää työn ilman kehotetta.

OpenAI toi Codexin agenttikoneiston kehittäjille hallittuna palveluna. Ajoympäristön saa valita itse, eikä rajapinnasta peritä erillistä maksua.

Qodo julkaisi Agentic Toolboxin, joka tuo riippumattoman katselmoinnin koodausagentin rinnalle jo ennen pull requestia.

EclipseSourcen sisäisestä työkalusta tuli avoin Eclipse Enclave. Jokainen agenttisessio saa oman konttinsa, tiedostonäkymänsä ja verkkosuodattimensa.

Tencentin MIT-lisensoitu teamai-cli jakaa tiimin skillit, säännöt ja MCP-asetukset Claude Codelle, Codexille ja Cursorille yhdestä Git-repositoriosta.

Devinin kehittäjä Cognition lähes kaksinkertaisti valuaationsa kolmessa kuukaudessa. Liikevaihto nousi 492 miljoonasta lähes 900 miljoonaan dollariin.

Speakeasyn avoin Kit korvaa kymmenet työkalukutsut yhdellä compose-ohjelmalla. Yhtiö mittasi noin puolet Claude Coden syötetokeneista.

Googlen avoin Mantis-kehys ajaa yli 15 agenttivaihetta: se etsii haavoittuvuudet, karsii virhehälytykset ja toistaa löydöt hiekkalaatikossa.

Google avasi Mantis-kehyksen lähdekoodin. Agenttiputki etsii haavoittuvuudet, toistaa ne hiekkalaatikossa ja kirjoittaa korjauksen.

Guild julkaisi Software Factoryn: kapeat agentit reitittävät, suunnittelevat ja katselmoivat työn. Niiltä tulee 34 prosenttia yhdistetyistä PR:istä.

Guildin Software Factory jakaa ohjelmistotyön kapeille agenteille. Yhtiön mukaan 34 prosenttia yhdistetyistä muutoksista syntyy jo automaattisesti.

Hugging Facen avoin funes indeksoi koodausagenttien vanhat istunnot paikallisesti ja antaa Claude Codelle, Codexille ja muille yhteisen muistin.

Spotifyn insinööri delegoi suurten tiedostojen luvun halvemmalle mallille Portalin kautta. Tokenien kulutus putosi mittauksissa keskimäärin 90 prosenttia.

GitHub avasi Project HydraFusionin tutkimusesikatseluun. Copilot rakentaa jokaiselle tehtävälle oman ajosuunnitelman usean mallin kesken.

GitHub avasi Copilotiin esikatselun, joka jakaa koodaustehtävän usealle mallille. TerminalBench-testissä laatu parani ja kustannus putosi 67 prosenttia.

Armaturen 16 893 ajon koe vertasi Claude Codea, Codexia ja Cursoria. Kolmikko valitsi saman työkalun vain 42 prosentissa kategorioista.

OpenAI toi GPT-6 Astran ensin yritysasiakkaille. Agenttikoodauksen tulos nousi 74,1 prosenttiin, ja hinta on 10 dollaria miljoonalta syötetokenilta.

Meta toi Muse Spark 1.3:n Muse Codeen ja rajapintaan. Agenttikoodauksen tulos nousi 55:stä 75,4:ään ja tokeneita kuluu neljännes vähemmän.

Google toi Gemini 3.8 Flashin markkinoille kolme viikkoa edeltäjänsä jälkeen. Koodaustulos nousi 73,7 prosenttiin ja tokenin hinta pysyi ennallaan.

Google avasi agenttimaisen videoymmärryksen Gemini 3.7 Flashille ja kahdelle muulle mallille. Tokenien kulutus putoaa jopa 88 prosenttia.

Anthropic julkaisi Claude Fable 5.1:n ja Mythos 5.1:n. Välimuistin lukuhinta putosi 75 prosenttia, ja pitkät agenttiajot halpenevat tuntuvasti.

Debianin yleisäänestys ratkesi vaihtoehtoon viisi: tekoälytyökaluja ei kielletä eikä suositella, mutta vastuu työn laadusta säilyy aina ihmisellä.

Amazon julkaisi Kiro Crew'n Apache 2.0 -lisenssillä. Sisäisesti MeshClaw-nimellä kehitetty työtila ajaa rinnakkaisia koodausagentteja ilman valvontaa.

Microsoftin avoin Agent Lightning kouluttaa agenttia ilman koodimuutoksia. Qwen3.5-9B nousi SWE-bench Verifiedissä 41,8 prosentista 56,4:ään.

OpenAI päättää Cursor-sopimuksensa 12. marraskuuta SpaceX-kaupan jälkeen. Cursorin mukaan OpenAI:n mallit kattavat vain viisi prosenttia liikenteestä.

Alibaban uusi Qoder ottaa tavoitteen vastaan luonnollisella kielellä. Yleistila avaa agenttityöpöydän myös niille, jotka eivät kirjoita koodia.

Googlen uusi videomalli jatkaa kohtausta 40 sekuntiin, lukee 10 sekuntia aiempaa kontekstia ja tuottaa 360p-vedokset kolmasosahinnalla.

Microsoftin Agent Host Protocol tekee agenttisessiosta siirrettävän. Claude Codessa aloitettu työ jatkuu VS Codessa ilman kontekstin uudelleenrakennusta.

Z.ai vahvisti, että OpenRouterin salaperäinen Ox Alpha on GLM-5.3-Flash. Malli ajettiin kiinalaisilla siruilla ja nousi viikon käytetyimmäksi.

Googlen uusi Gemini 3.5 Transcribe litteroi puhetta 2,6 prosentin virheasteella ja korvaa Chirp 3:n. Malli on nyt esikatselussa Gemini-rajapinnassa.

IBM julkaisi Granite 4.2 -mallit kolmessa koossa Apache 2.0 -lisenssillä. Isommat versiot koulutettiin vahvistusoppimisella oikeissa kehitysympäristöissä.