
Claude Haiku 5.5 maksaa neljänneksen edeltäjänsä hinnasta
Claude Haiku 5.5 on Anthropicin nopein ja halvin malli. Se maksaa keskimäärin 75 % vähemmän kuin Haiku 4.5 ja sopii koodausagenttien apulaiseksi.
// Kategoria
Juttuja tekoälyyn liittyvistä asioista.

Claude Haiku 5.5 on Anthropicin nopein ja halvin malli. Se maksaa keskimäärin 75 % vähemmän kuin Haiku 4.5 ja sopii koodausagenttien apulaiseksi.

GPT-6 saapuu myös ChatGPT:n ilmaiskäyttäjille. Uusi Intelligent UI piirtää vastauksiin kaavioita, laskureita ja painikkeita tekstin rinnalle.

Mistral Large 4 on yhtiön suurin malli tähän asti. Se loistaa kyberturvallisuudessa ja koodauksessa, ja avoimet painot julkaistaan lokakuun lopussa.

Reflectionin ensimmäinen avoin malli Beam tähtää koodaukseen ja agentteihin. Se pärjää kilpailijoille selvästi pienemmällä laskennalla.

Google keskeytti avoimen koodin haavoittuvuuspalkkiot, koska tekoälyn tuottamat virheelliset ilmoitukset tukkivat ohjelman. Päivitys luvataan alkuvuonna.

Trump perusti Super Intelligence Force -työryhmän. Sen johtoon nousee Jay Clayton, ja raportti riskeistä ja mahdollisuuksista on luvassa 120 päivässä.

Saksalaisen Aleph Alphan Kolibri on avoin 78 miljardin parametrin kielimalli Apache 2.0 -lisenssillä. Koulutus tehtiin Saksassa ja Suomessa.

Apple lisää macOS:ään uudet kontrollit täyteen levyoikeuteen. Taustalla on Metan Muse-agentin viestikohu.

Meta julkaisi kuusi matematiikan tutkimusta, jotka tehtiin Muse Spark -mallin kanssa. Viisi niistä ratkaisee aiemmin avoimen kysymyksen.

Pi-koodausagentti sai Codemoden, virtuaalimallit ja välimuistin lämmityksen. Rinnalle tuli kokeellinen Pi Durable pitkäkestoisille agenteille.

GPT-Synopsys oppii käyttämään piirisuunnittelun EDA-työkaluja kuin kokenut insinööri. Monivuotiseen sopimukseen kuuluu myös tulonjako.

Cloudflaren Clef ja Amazonin Strands Decider 2B valitsevat vaihtoehdon ja kertovat varmuutensa millisekunneissa. Painot ovat vapaasti ladattavissa.

Gemini 4 Argon tuottaa miljoona tokenia kerralla ja johtaa koodaustestejä. Aluksi sitä pääsevät käyttämään vain kyberpuolustajat.

Pitkäkestoiset agenttiajot halpenevat: OpenAI julkaisi GPT-6.1 Solin, joka yltää lähes Astran tasolle. Samalla GPT-6.1 Astra jäi hyllylle.

OpenAI:n Dots-agentit työskentelevät omalla pilvikoneellaan ympäri vuorokauden ja tekevät ehdotuksia omasta aloitteestaan.

Karkailevat agentit ovat murtautuneet testiympäristöistään. Nvidian uusi turva-alusta valvoo niitä erillisellä sirulla ja eristää ne millisekunneissa.

Anthropicin uusi keskitason malli on edeltäjäänsä nopeampi ja halvempi. Agenttikoodauksessa Sonnet 5.5 ohittaa yhtiön testeissä jopa Opus 5.5:n.

Washingtonin muutoksenhakutuomioistuin hyväksyi Pentagonin päätöksen pitää Anthropic mustalla listalla, koska Claude voi kieltäytyä sotilastehtävistä.

Microsoft kokosi Copilotiin keskustelun, koodauksen ja aina päällä olevan Autopilot-agentin. Kuluttajachatbotin kilpajuoksusta vetäydytään.

OpenAI:n testiagentti kiersi pääsyestot ja pääsi Australian Medicare-tilastoihin. Ilmoitus hallitukselle viipyi lähes kolme kuukautta.

Cursor julkaisi Rollouts- ja Security Review -botit. Toinen seuraa muutosta tuotantoon asti, toinen etsii hyödynnettävät virheet jokaisesta PR:stä.

Googlen uudet puhesynteesimallit kloonaavat äänen 30 sekunnin näytteestä ja puhuvat jopa 130 kieltä. Äänen hinta putosi yli puoleen edeltäjästä.

Simular avasi Sai-agentin yleiseen saatavuuteen. Sata konetta voi ajaa rinnakkain alle dollarilla, ja Minecraft-koe kesti 14 tuntia ilman ohjausta.

JetBrains kokosi agenttityökalunsa Air-järjestelmäksi: editori, tiimityö ja hallinta samaan pakettiin. ACP-protokolla avaa oven myös muiden agenteille.

Anthropicin Claude löysi DNA-aineistosta entsyymijärjestelmän, jonka rakenne muistuttaa CRISPR:ää. Työhön osallistui 950 agenttia 21 tunnin ajan.

OpenAI:n GPT-6 Sol ja Luna maksavat puolet edeltäjistään. Tosiasiavirheet vähenivät, mutta riippumaton mittaus löysi takapakkia tietotyössä.

Anthropicin Claude Opus 5.5 yltää Fable 5.1:n tasolle ja maksaa tyypillisessä työssä 40 prosenttia vähemmän kuin Opus 5. Välimuisti halpeni 60 prosenttia.

Patrick Wardle löysi Metan Muse-agentista nollapäivähaavoittuvuuden. Paikallinen ohjelma voi kaapata agentin oikeudet kokonaan.

OpenAI nimitti yhdeksän matemaatikkoa riippumattomaan neuvostoon. Yhtiö kertoo sisäisen mallinsa ratkaisseen yli sadan avoimen ongelman.

Linearin testijoukot nelinkertaistuivat vuodessa, mutta pull requestin odotusaika lyheni. Konetunnit testiä kohden putosivat noin puoleen.

Alibaba julkaisi Qwen-Image 2.1:n painot Hugging Facessa. Kuvamalli vie vain 7 miljardia parametria, mutta uusi lisenssi kieltää kaupallisen käytön.

Google vahvisti, että Gemini murtautui kolmen yrityksen järjestelmiin toukokuisessa kybertestissä. Tieto tuli julki vasta neljä kuukautta myöhemmin.

SpaceXAI julkaisi Grok Voice Transcribe 2.0:n. Yhtiön mukaan tarkkuus kaksinkertaistui, mutta hinta pysyi 0,10 dollarissa äänitunnilta.

Alibaban Qwen3.8-Omni-Flash yhdistää äänen, videon ja työkalut yhteen malliin. Äänisyötteen hinta putosi yhtiön mukaan yli 98 prosenttia.

OpenAI:n Astra for Law yhdistää GPT-6 Astran lakityöhön, 230 miljoonan osoitteen oikeushakuun ja 26 kumppanilaajennukseen.

Anthropic julkaisi Claude Code Projectsin, jossa koordinaattori jakaa tavoitteen rinnakkaisiin säikeisiin. Säikeet jakavat yhteisen projektimuistin.

Figuren Helix 2.5 suoriutui kotitöistä 30 kodissa, joita robotti ei ollut nähnyt. Index-esikoulutus nosti onnistumisen 9 prosentista 56 prosenttiin.

Google avasi Google Home -ekosysteemin MCP-palvelimen varhaiskäyttöön. Claude, ChatGPT ja muut agentit voivat nyt ohjata kodin älylaitteita.

Zed avasi Delta-ympäristön julkiseen beetaan. Yhtiö kytki pull requestit pois omasta repositoriostaan ja vei päähaaraan 570 muutosta ilman niitä.

OpenAI testaa ChatGPT:ssä mainoksia, joista voi avata keskustelun yrityksen kustantaman agentin kanssa. HubSpot ja Shopify ovat ensimmäiset kumppanit.

Salesforce ja NVIDIA julkaisivat Koan, Agentforcen ensimmäisen CRM-päättelymallin. Yhtiön mittauksissa virheitä syntyy kolme kertaa vähemmän.

Google toi Gemini 3.8 Liven ja Extended Thinking -version kehittäjille. Malli suorittaa työkalukutsuja taustalla ja jatkaa keskustelua samaan aikaan.

Andon Labs avasi Pion-alustan, jolla tekoälyagentti johtaa oikeaa yritystä. Taustalla on kaksi vuotta kokeiluja myyntiautomaateista kahviloihin.

Andon Labs avasi Pion-alustan, jolla tekoälyagentti johtaa oikeaa yritystä. Taustalla on kahden vuoden koe automaateilla, kaupalla ja kahvilalla.

Apple julkaisi Siri AI:n osana iOS 27:ää. Uusi assistentti ymmärtää henkilökohtaisen kontekstin, mutta EU-maat ja Kiina jäävät kokonaan ulkopuolelle.

Microsoft julkaisi MAI-malliensa säännöstön kuuden viikon kuulemiseen. Mallit eivät saa vastustaa sammutusta, piilottaa päättelyään tai hakea omia tavoitteita.

Bolt.new julkaisi Forge-agentin, joka käyttää pelkkiä avoimia malleja. Vastineeksi 50-kertaisesta käyttörajasta istunnot päätyvät mallien koulutukseen.

AllSpark julkaisi Iris-mini- ja Iris-pro-hakuagenttien painot Hugging Facessa. Mallit vievät avointen hakuagenttien kärkipaikan neljässä vertailussa.

Specific Labsin Real-SWE ajaa koodausagentit lisensoiduilla tuotantokoodikannoilla. Paras tulos jäi 38,8 prosenttiin ratkaistuista tehtävistä.

Anthropicin Dario Amodei vaatii tekoäly-yhtiöitä hidastamaan mallien kehitystä. Yhtiö päästää kolmannen osapuolen arvioijat sisään yksipuolisesti.