
Ox Alpha ilmestyi OpenRouteriin: kukaan ei kerro tekijää
Ox Alpha lupaa miljoonan tokenin kontekstin ilmaiseksi, mutta kukaan ei kerro kuka mallin rakensi. OpenRouterin stealth-julkaisu kuumensi arvailun.
// Kategoria

Ox Alpha lupaa miljoonan tokenin kontekstin ilmaiseksi, mutta kukaan ei kerro kuka mallin rakensi. OpenRouterin stealth-julkaisu kuumensi arvailun.

Model Context Protocolin uusi tiekartta nostaa agenttien identiteetin, webhookit ja työkalujen asteittaisen löytämisen kehitystyön kärkeen.

Slack upottaa Claude Coden, Devinin ja Copilotin suoraan kanaviin, joissa koko tiimi voi seurata ja ohjata agentin työtä.

OpenAI julkaisi Codexin agenttiytimen avoimena lähdekoodina: CLI, SDK ja app-server antavat kehittäjille pääsyn samaan koneistoon.

UiPath julkaisi Maestro Flow'n, jossa Claude Code, Cursor ja Copilot rakentavat kokonaisia liiketoimintaprosesseja yhtenä hallittuna artefaktina.

Warp julkaisi Factories-alustan, jossa agenttitiimi vie tiketin triagesta katselmointiin. Ihminen hyväksyy määrittelyn ja yhdistää koodin.

Ornith-1.5 luo itse harjoitustehtävänsä ja kehittyy niistä. Avoin 397B-malli yltää Claude Opus 4.8:n tasolle koodaus- ja agenttivertailuissa.

Cursor avasi Origin-koodipalvelun samana päivänä, kun GitHub kaatui lähes seitsemäksi tunniksi. Palvelu on rakennettu agenttien mittakaavaan.

Wizin autonominen tutkimusagentti löysi Snowflaken GitHub-työnkulusta injektioaukon, jonka Copilotin tekoälytarkistus oli päästänyt läpi puhtaana.

Alibaban 27 miljardin parametrin avoin malli yltää agenttivertailuissa kaupallisten kärkimallien tasolle – ja mahtuu tavallisen työaseman muistiin.

Cursorin builds-toiminto pitää kehitysympäristöt valmiina taustalla. Tänään ominaisuus kytkeytyy päälle oletuksena kaikissa ympäristöissä.

SpaceX sai Cursor-kaupan päätökseen 14. elokuuta. Osakevaihto arvotti Anysphären 60 miljardiin dollariin, ja tiimi siirtyy Grokin kehitykseen.

DeepSeek toi markkinoille MIT-lisensoidun Harness-agenttirungon ja julkaisi V4-Pron virallisen version, jossa agenttikyvyt paranivat selvästi.

Z.ai:n uusi GLM-5.3 nousi avointen mallien kärkeen koodauksessa, mutta yllättävä kyberkyvykkyys siirsi painojen julkaisua kahdella viikolla.

Google toi Gemini 3.7 Flashin markkinoille kolme viikkoa edeltäjänsä jälkeen. Koodaustulokset paranivat selvästi ja tokenien hinta putosi puoleen.

SpaceXAI julkaisi Grok 4.6:n. Malli keskittyy pitkiin agenttiajoihin ja on saatavilla Cursorissa hintaan 2 dollaria miljoonalta syötetokenilta.

OpenAI jakoi Daybreak-ohjelmansa Blue- ja Red-tasoihin ja toi tarjolle GPT-5.6-Cyberin, joka vastaa 95 prosenttiin tietoturvakyselyistä.

Anthropic tekee automaattitilasta Claude Coden oletuksen 14. elokuuta. Testissä se havaitsi 89 prosenttia haitallisista toimista, ihminen 13,6.

Yli 40 000 pelikierroksen aineisto paljastaa, että kehittäjä hyväksyy tekoälyagentin haitallisen komennon joka kolmannella kerralla.

Alibaban Qwen3.8-Max kiipesi Artificial Analysisin agenttivertailun huipulle. Menetelmäpäivitys pudotti sen samana päivänä toiseksi.

Liquid AI:n LFM2.5-2.6B ajaa työkalukutsuja ja monivaiheisia agentteja paikallisesti, alle 2,5 gigatavun muistilla ja ilman pilviyhteyttä.

Googlen Managed Agents -palveluun tuli ympäristökoukut, tokenbudjetit, ajastetut liipaisimet ja ilmainen taso. Oletusmalliksi vaihtui Gemini 3.6 Flash.

OpenAI:n uusi Codex Security -komentorivityökalu ja TypeScript-SDK etsivät, vahvistavat ja korjaavat haavoittuvuuksia koodivarastoista.

Kuaishoun KwaiKAT-tiimi rakensi yli 100 000 suoritettavaa koodivarastoa harjoitteluun. Tuloksena malli, joka voittaa Opus 4.8:n PinchBench-testissä.

Anthropic karsi Claude Coden järjestelmäkehotteesta yli 80 prosenttia ilman mitattavaa laskua koodausvertailuissa. Ohjeista siirryttiin arvostelukykyyn.

Redis julkaisi seitsemän tietoturvapäivitystä sen jälkeen, kun tekoälyagenttien kerrotaan löytäneen nollapäivähaavoittuvuuksia tunneissa.

Claude Opus 5 yltää lähes Fable 5:n tasolle puolella hinnasta ja nousee kärkeen agenttikoodauksessa. Malli on jo saatavilla myös GitHub Copilotissa.

Anthropic toi Claude Securityn Claude Codeen: moniagenttinen skanneri etsii haavoittuvuudet ja ehdottaa korjaukset suoraan terminaalissa.

Poolsiden 118 miljardin parametrin Laguna S 2.1 pärjää monin verroin isommille malleille agenttikoodauksessa ja julkaisee testijäljet avoimesti.

Model Context Protocol siirtyy tilattomiin istuntoihin. Päivitys poistaa pullonkaulan, joka on estänyt laajat agentti-integraatiot yrityksissä.

JUCE:n luoja Julian Storer julkaisi Jugglerin: avoin graafinen koodausagentti, jonka istunnot ovat haarautuvia dokumentteja lokien sijaan.

xAI julkaisi Grok 4.5:n, koodaukseen viritetyn mallin, jossa on 500 000 tokenin konteksti ja tiukka hinnoittelu. Malli integroituu suoraan Cursoriin.

Anthropic toi Claude Coden työpöytäsovellukseen hiekkalaatikoidun selaimen. Agentti voi nyt selata, klikata ja testata sivuja ilman erillistä ikkunaa.

Google Labs julkaisi stitch-skills-kirjaston, joka tuo Stitch-suunnittelutyökalun Claude Codeen, Cursoriin ja Codexiin avoimena agenttitaitona.

Cognition julkaisi SWE-1.7:n Deviniin. Kimi K2.7:n päälle rakennettu malli yltää lähelle kärkeä ja haastaa käsityksen jälkikoulutuksen ylärajasta.

Meta julkaisi Muse Spark 1.1:n ja avasi Meta Model API:n. Agenttimalli orkestroi aliagentteja miljoonan tokenin kontekstissa ja koodaa edullisesti.

Microsoft julkaisi ensimmäisen oman koodausmallinsa MAI-Code-1-Flashin GitHub Copilotiin. Nopea MoE-malli vähentää OpenAI-riippuvuutta.

Apple toi Safari Technology Preview 247:ään MCP-palvelimen, joka antaa Claude- ja Codex-agenttien tutkia ja debugata sivuja suoraan Safarissa.

Avoin ctx-työkalu indeksoi tekoälyagenttien istuntohistorian SQLite-tietokantaan. Se ratkaisee agenttien muistiongelman yhdellä komennolla.

Mistral julkaisi avoimen Leanstral 1.5:n, Lean 4 -todistusmallin. Se ratkaisi 587 PutnamBench-ongelmaa 672:sta ja löysi viisi tuntematonta bugia.

Moonshotin avoin Kimi K2.7 Code on ensimmäinen avoimen painon malli GitHub Copilotin mallivalikossa. Se tuo halvemman vaihtoehdon koodaustyöhön.

Z.ai julkaisi ZCoden, ilmaisen agenttipohjaisen kehitysympäristön GLM-5.2-mallille. Työkalu haastaa Cursorin ja Claude Coden.

Meituan avasi LongCat-2.0:n, 1,6 biljoonan parametrin MoE-koodausmallin, joka koulutettiin kokonaan kiinalaisilla piireillä.

Anthropic julkaisi Claude Sonnet 5:n, joka yltää lähelle Opus 4.8:aa agenttityössä mutta selvästi matalammalla hinnalla.

DeepSeek avasi DSparkin ja DeepSpec-koodiston: spekulatiivinen dekoodaus nopeuttaa V4-mallien päättelyä 60–85 % ilman laadun heikkenemistä.

Vercel julkaisi AI SDK 7:n: kirjasto saa yhtenäisen telemetrian ja kestävät WorkflowAgent-agentit, jotka jatkuvat palvelimen uudelleenkäynnistyksen yli.

DeepReinforcen Ornith-1.0 on neljän koon avoin koodausmalliperhe MIT-lisenssillä. Malli oppii rakentamaan oman telineensä vahvistusoppimisen aikana.

Mistral julkaisi OCR 4:n, joka poimii dokumenteista rakenteista tietoa 170 kielellä ja jonka voi ajaa kokonaan oman organisaation infrastruktuurissa.

Anthropic toi Claude Tagin Slackiin: @Claude-merkinnällä kuka tahansa voi antaa tekoälylle tehtävän, jonka se hoitaa ja raportoi viestiketjuun.

OpenAI laajensi Daybreak-ohjelmaansa, julkaisi täyden GPT-5.5-Cyber-mallin ja käynnisti Patch the Planet -hankkeen avoimen lähdekoodin korjaamiseksi.