Microsoft julkaisi 9. lokakuuta Microsoft-Decision-1-mallin, joka ei tuota tekstiä vaan todennäköisyyksiä valmiille vastausvaihtoehdoille. Malli on tarkoitettu reititykseen, luokitteluun, priorisointiin ja työnkulkujen ohjaukseen. Se on saatavilla Microsoft Foundryssa ja OpenRouterin kautta.

Samana päivänä kilpaileva TypeSafe AI kertoi keränneensä 870 miljoonaa dollaria 7,5 miljardin dollarin valuaatiolla. Uutiset yhdessä vahvistavat, että päätösmalleista on tullut tekoälyn oma kategoriansa. Kyse ei ole enää kokeilusta vaan kilpailusta yritysasiakkaista.

Mikä päätösmalli on

Kielimalli kirjoittaa vastauksen sana kerrallaan. Päätösmalli saa kysymyksen ja kiinteän joukon vaihtoehtoja, ja se palauttaa jokaiselle vaihtoehdolle kalibroidun todennäköisyyden. Ohjelmisto voi toimia tuloksen perusteella suoraan ilman tekstin jäsentämistä.

Microsoft rakensi mallin jatkokouluttamalla Alibaban avointa Qwen3.5-9B-mallia nopeisiin, yhdellä läpikäynnillä tehtäviin päätöksiin. Yhtiö aikoo myöhemmin rakentaa saman mallin myös omien MAI-malliensa ja OpenAI:n mallien päälle. Decision-1 tukee kyllä/ei-kysymyksiä, monivalintoja, arvosanoja sekä tekoälyn vastausten arviointia annetun kriteeristön mukaan.

Todennäköisyys on osa rajapintaa eikä pelkkä järjestysluku. Microsoftin mukaan 90 prosentin ennusteen pitäisi osua oikeaan noin yhdeksän kertaa kymmenestä. Sovellus voi siksi päättää, toimiiko se itse, odottaako vai siirtääkö tapauksen ihmisen tarkistettavaksi.

Vakautta testattiin muotoilemalla sama pyyntö kahdeksalla eri tavalla. Päätös muuttui keskimäärin 1,3 prosentissa tapauksista. Kun vaihtoehtojen järjestystä sekoitettiin tai niiden kuvaukset muotoiltiin uudelleen, päätös ei muuttunut kertaakaan.

Rautatien vaihde haarautuu hämärässä useaksi valaistuksi raiteeksi

Nopeus ja hinta ratkaisevat

Microsoftin mukaan Decision-1 saavutti parhaan tarkkuuden 36 vertailutestin kokonaisuudessa, jossa oli lähes 150 000 kysymystä. Testit pidettiin erillään koulutusdatasta. Mallin mediaaniviive oli noin 35 kertaa pienempi kuin OpenAI:n GPT-6 Solilla ja 4,5 kertaa pienempi kuin toiseksi tulleella Quyet-1.0-Large-mallilla.

Hinnoittelu on poikkeuksellinen. Syötetokenit maksavat 0,042 dollaria miljoonalta, ja tulostetokenit ovat ilmaisia. Koska malli palauttaa vain todennäköisyydet, tulosteen osuus jäisi muutenkin pieneksi.

Nopeus korostuu agenttien työnkuluissa, joissa päätökset seuraavat toisiaan. Microsoft havainnollistaa asiaa laskulla: jos jokainen 20 peräkkäisestä päätöksestä hidastuu 100 millisekuntia, koko työnkulku hidastuu kaksi sekuntia. Pienellä mallilla viive kasautuu hitaammin.

Vertailuluvut ovat Microsoftin omia. Riippumattomia mittauksia ei vielä ole, ja valmistajan valitsemat testit suosivat usein omaa mallia. Lukuja kannattaa siksi pitää suuntaa antavina.

Valojuovat kiitävät pimeän palvelinsalin käytävällä palvelinkaappien välissä

Microsoftin omat kokeilut

Microsoft on testannut mallia omissa tiimeissään. Xbox Research luokitteli sen avulla yli 10 000 kyselyvastausta, Steam-arvostelua ja X-julkaisua tutkijoiden määrittelemiin teemoihin. Laatu oli yhtiön mukaan GPT-6 Solin tasolla, mutta ajo oli yli 14 kertaa nopeampi ja 200 kertaa edullisempi.

Copilot-tiimi käytti mallia keskustelu- ja agenttivastausten laadunvalvontaan. Tulokset olivat GPT-5.6 Lunan tasoa sata kertaa nopeammin. Päivystävät insinöörit puolestaan hakivat mallin avulla häiriötilanteissa oikeaa tietoa lokeista, tiketeistä ja viesteistä.

Microsoft Discovery -tutkimusalustalla malli arvioi kokeiden tuloksia ja ohjasi seuraavaa suunnitelmaa. Arviot olivat 46 kertaa johdonmukaisempia kuin kielimallin pisteytys. Uudelleensuunnittelu nopeutui lähes nelinkertaisesti.

Automaation näkökulmasta tärkeimmät käyttökohteet ovat arkisia. Pyynnön ohjaaminen oikealle mallille, asiakaspalautteen luokittelu, syötteiden validointi ja agentin seuraavan askeleen hyväksyminen ovat juuri niitä vaiheita, joissa kallis kielimalli on tähän asti tehnyt yksinkertaista työtä.

Hämärä valvomo, jossa kolme näyttöä näyttää kojelautoja ja tikettijonoja

TypeSafe ja Jev nostavat panoksia

TypeSafe AI julkaisi Jev-päätösmallinsa 15. syyskuuta. TechCrunchin mukaan yhtiö keräsi nyt 870 miljoonaa dollaria Andreessen Horowitzin johdolla, ja mukana ovat myös Sequoia ja aiempi sijoittaja DCVC. Valuaatio nousi 7,5 miljardiin dollariin alle kuukaudessa julkaisusta.

Yhtiön mukaan kolmannes Fortune 500 -yrityksistä käyttää jo Jeviä. Perustajiin kuuluu entinen OpenAI-tutkija Diogo Almeida. Hänen mukaansa kielimallit hallitsevat ihmisten kielen, mutta automaatio tarvitsee koneiden kieltä.

Microsoftin julkaisu viittaa suoraan tähän kilpailuun. Yhtiö kertoo testanneensa mallinsa JevBench-tulostaulukon kärkimalleja vastaan ja ohittaneensa ne laajemmassa testisarjassa. Cloudflare ja Amazon ovat jo aiemmin avanneet omat päätösmallinsa.

Markkinalla on nyt startup lähes miljardin rahoituksella ja pilvijätti, joka antaa tulosteen ilmaiseksi. Hintapaine kohdistuu suoraan TypeSafen liiketoimintaan. Toisaalta Microsoftin tulo vahvistaa, että kategoria on tullut jäädäkseen.

Lasiseinäinen neuvotteluhuone Piilaaksossa kultaisessa iltavalossa

Yhteenveto

Microsoft-Decision-1 tuo päätösmallit suuren pilvialustan valikoimaan erittäin halvalla hinnalla. Vertailuluvut ovat toistaiseksi Microsoftin omia. TypeSafen 870 miljoonan dollarin kierros osoittaa, että myös sijoittajat uskovat samaan suuntaan.

Automaatiota rakentaville muutos on käytännöllinen. Luokittelu, reititys ja tarkistukset voidaan siirtää kielimallilta erikoistuneelle mallille, joka vastaa todennäköisyydellä ja maksaa murto-osan. Ennen tuotantokäyttöä mallin tarkkuus kannattaa silti mitata omalla datalla.