Google julkaisi 2. syyskuuta Gemini 3.8 Flashin ja sen kyberturvaan viritetyn Flash Cyber -version. Kyseessä on yhtiön kolmas Flash-julkaisu kuudessa viikossa. Edellinen malli, 3.7 Flash, ilmestyi vain kolme viikkoa aiemmin.
Uutuuden pääviesti on koodaus. Google kertoo mallin yltävän pitkäkestoisissa ohjelmistotehtävissä lähes kärkimallien tasolle, mutta murto-osalla niiden hinnasta. Samalla yhtiön lupaama Gemini 3.5 Pro loistaa yhä poissaolollaan.
Kolmas Flash-malli kuudessa viikossa
Julkaisutahti on poikkeuksellinen. Google on tuonut markkinoille kolme Flash-mallia kuudessa viikossa: 3.6 Flashin heinäkuussa, 3.7 Flashin 13. elokuuta ja nyt 3.8 Flashin. Jokainen on ollut edeltäjäänsä parempi koodauksessa.
Samaan aikaan yhtiön huipputason Pro-malleista ei ole kuulunut. Ars Technican mukaan Google ei ole julkaissut uutta kärkitason Gemini Pro -mallia sitten alkuvuoden 2026. Gemini 3.5 Pron julkaisua kerrotaan lykätyn, koska sen koodaustulokset eivät yltäneet kilpailijoiden tasolle.
Google itse ei näe tahdissa ongelmaa. Molemmat 3.8-versiot rakentuvat samalle perustalle, ja yhtiö kertoo hioneensa mallia pitkillä agenttisilmukoilla, jotka arvioivat ja korjaavat mallia toistuvasti. Osa koodausparannuksista syntyi sivutuotteena kyberturvakoulutuksesta.
DeepMindin uusi johtaja Koray Kavukcuoglu on korostanut, ettei yhtiö tyydy pelkkään hinta-laatusuhteeseen. Lupaus kärkitason mallista on siis yhä voimassa. Aikataulu vain puuttuu.

Koodaustulokset harppasivat, päättely ei
Selvin muutos näkyy komentorivitehtävissä. Terminal-Bench 2.1 -testissä 3.8 Flash ylsi 90,8 prosenttiin, kun edeltäjä jäi 81,6 prosenttiin. Yhdeksän prosenttiyksikön hyppy kertoo suoraan paremmasta agenttikoodauksesta.
Pitkäkestoisessa ohjelmistokehityksessä ero kärkeen kaventui. DeepSWE v1.1 -vertailussa malli sai 73,7 prosenttia. Claude Opus 5 on 74,0 prosentissa ja GPT-5.6 Sol 72,7 prosentissa, joten kolmikko on käytännössä tasoissa.
Kaikki ei kuitenkaan noussut. Humanity's Last Exam -testissä tulos pysyi paikallaan: 45,4 prosenttia vastaan edeltäjän 45,7. SWE-Bench Prossa nousu jäi runsaaseen prosenttiyksikköön, 60,4:stä 61,6:een. Parannus keskittyy työkalujen käyttöön, ei avoimeen päättelyyn.
Tietokoneen käyttö on yhä Googlen heikko kohta. OSWorld-2.0-testissä 3.8 Flash paransi edeltäjäänsä, mutta jäi selvästi Claude Opuksen taakse. Riippumaton Artificial Analysis nosti mallin älykkyysindeksin 56:sta 59:ään.

Hinta pysyi, mutta tokeneita kuluu enemmän
Hinnoittelu ei muuttunut. Miljoona syötetokenia maksaa 0,75 dollaria ja miljoona tuotostokenia 3,75 dollaria. Hinta on voimassa 31. joulukuuta asti, minkä jälkeen se kaksinkertaistuu 1,50 ja 7,50 dollariin.
Vertailu kilpailijoihin on jyrkkä. Claude Opus 5 maksaa 5 dollaria syötteestä ja 25 dollaria tuotoksesta, GPT-5.6 Sol 4 ja 20 dollaria. Ero säilyy Googlen hyväksi myös kampanjahinnan päätyttyä.
Tokenin hinta ei silti kerro koko totuutta. Google myöntää, että 3.8 Flash tekee enemmän töitä: se ajaa vaikeissa tehtävissä ylimääräisiä päättelyaskelia ja kutsuu työkaluja toistuvasti. Artificial Analysisin mittauksessa tehtäväkohtainen kustannus nousi 0,40 dollarista 0,58 dollariin.
Siksi Google pitää 3.7 Flashin edelleen tuettuna. Yhtiö suosittelee vanhempaa mallia tai matalampaa päättelytasoa silloin, kun laskentatehon kulutus on tärkein rajoite. Uutuus kannattaa valita monivaiheisiin tehtäviin, joissa lopputulos on tarkistettavissa.

Flash Cyber jää luotettujen puolustajien käyttöön
Toinen julkaistu versio, Gemini 3.8 Flash Cyber, ei tule vapaaseen jakeluun. Google avaa sen uuden Fairwind-ohjelman kautta viranomaisille, kriittisen infrastruktuurin ylläpitäjille ja ohjelmistojen ylläpitäjille. Pääsyä haetaan erikseen.
Syy rajaukseen on turvallisuusasetuksissa. Kyberversiossa on väljemmät rajoitteet kuin yleisessä mallissa, koska puolustustyö vaatii pääsyn haavoittuvuuksien yksityiskohtiin. Google kertoo priorisoineensa korjaamista hyväksikäytön sijaan.
Luvut ovat vahvoja. CyberGym-vertailussa malli sai 86,2 prosenttia, kun edeltävä 3.5 Flash Cyber jäi 77,5 prosenttiin. Ulkoisessa CWE-Bench-korjaustestissä tulos oli 47,2 prosenttia, käytännössä kärkimallin 47,8 prosentin tasolla mutta selvästi halvemmalla.
Google käyttää mallia jo omassa koodissaan. Chromen tietoturvatiimin mukaan 3.8 Flash Cyber tuotti 2,6 kertaa enemmän toimivia korjauksia kuin selvästi suuremmat kaupalliset mallit. Pilvipalvelujen haavoittuvuustutkimus löysi sen avulla kriittisen aukon alle kahdessa tunnissa, kun työhön kuluu yleensä kuukausia.

Yhteenveto
Gemini 3.8 Flash on kapea mutta selkeä parannus. Koodaus ja työkalujen käyttö harppasivat, avoin päättely ei liikkunut, ja hinta pysyi ennallaan. Googlen virallisen blogin mukaan sama perusta ajaa myös kyberversiota.
Kehittäjälle laskelma on suoraviivainen. Jos työ koostuu monivaiheisista agenttitehtävistä, uutuus tuottaa parempaa jälkeä tutulla hinnalla. Jos taas token-budjetti on tiukka, 3.7 Flash on yhä perusteltu valinta.
