Alibaban Qwen-tiimi julkaisi 18. syyskuuta Qwen3.8-Omni-Flashin. Malli ottaa vastaan tekstiä, kuvia, ääntä ja videota ja vastaa tekstillä. Yhtiön mukaan se on Qwenin ensimmäinen omnimodaalinen malli, joka on suunniteltu alusta asti agenttikäyttöön. Painopiste ei ole sisällön tunnistamisessa vaan siinä, mitä malli tekee tunnistamansa jälkeen.

Julkaisun kärki ei ole raaka suorituskyky vaan hinta. Alibaban omien lukujen mukaan äänisyötteen hinta putosi yli 98 prosenttia edeltäjään verrattuna. Malli lukee kerralla miljoona tokenia, mutta avoimia painoja ei julkaistu. Kaikki julkaistut mittaustulokset ovat toistaiseksi yhtiön itsensä raportoimia.

Neljä syötemuotoa, yksi päättelyketju

Qwen3.8-Omni-Flash kokoaa yhteen malliin sen, mikä aiemmin vaati useita erillisiä palasia. Se kuuntelee äänen, katsoo videon sekä lukee kuvan ja tekstin. Ulos tulee tekstiä, ei ääntä tai kuvaa. Miljoonan tokenin konteksti-ikkuna riittää pitkiin tallenteisiin ilman, että aineisto pitää pilkkoa ja liittää takaisin yhteen.

Qwen-tiimin kuvaus työnkulusta on nelivaiheinen. Malli ymmärtää sisällön, suunnittelee tehtävän, suorittaa sen työkaluilla ja palauttaa tuloksen. Painopiste on todisteiden keräämisessä usean kierroksen ajan. Pelkkä sisällön kuvailu ei ole enää tavoite.

Malli on saatavilla Qwen Chatissa, Alibaba Cloudin Model Studiossa, QwenCloudissa ja Qwen Studiossa. Rajapinta noudattaa sekä DashScope- että OpenAI-protokollaa, ja käytössä ovat sekä Chat Completions että Responses API. Tuettuina ovat funktiokutsut, verkkohaku, rakenteiset vastaukset, kontekstin välimuisti ja eräajot.

Käyttötapauksiksi Qwen listaa vlogien automaattisen editoinnin, lyhytvideoiden kääntämisen, palaverien tiivistämisen ja kokopitkien elokuvien muuttamisen jäsennellyiksi koosteiksi. Yhteistä näille on se, että malli joutuu käymään saman aineiston läpi useaan kertaan. Juuri toistokertojen määrä on aiemmin tehnyt tällaisista työnkuluista kalliita.

Ohjaamon näytöllä neljä syöteraitaa – ääni, video, kuva ja teksti – sulautuu yhdeksi kirkkaaksi raidaksi.

Hinnanlasku on julkaisun varsinainen uutinen

Alibaba ilmoitti, että äänisyötteen tuntihinta laski yli 98 prosenttia edeltäjästä Qwen3.5-Omni-Plusista. Yhdistetyn ääni- ja kuvasyötteen hinta putosi yli 93 prosenttia. Videosyötteen osalta lasku oli yhtiön mukaan noin 89 prosenttia. Vertailukohtana toimii siis yhtiön oma edellinen sukupolvi, ei kilpailijan malli.

Model Studion hinnasto asettaa mallin 0,15 dollariin miljoonalta syötetokenilta ja 0,47 dollariin miljoonalta vastaustokenilta. Välimuistista luetut tokenit maksavat 0,016 dollaria miljoonalta. Sama hinta koskee rinnalla julkaistua Qwen3.8-Flashia, joka käsittelee vain tekstiä ja kuvaa. Ääni ja video eivät siis enää maksa enempää kuin teksti.

Hinnan rinnalla laski myös tokenien kulutus. OmniVideoBench-testissä malli käytti 79 117 tokenia aiemman 145 736:n sijaan. Halvempi tokeni ja pienempi kulutus kertautuvat pitkissä ääni- ja videotyönkuluissa. Lopullinen säästö on siksi suurempi kuin pelkkä hinnaston muutos antaa ymmärtää.

Käytännössä muutos siirtää ääni- ja videotyönkulut kokeiluista tuotantoon. Tunnin mittaisen tallenteen läpikäynti oli aiemmin kallis operaatio, joka kannatti tehdä kerran. Nyt saman aineiston voi ajaa läpi useita kertoja eri kysymyksillä. Kertaluontoisen tiivistyksen sijaan aineistoon voi siis palata aina uudelleen.

Jyrkästi laskeva portaikko hehkuvista lasikuutioista pimeässä tilassa, kuvaa romahtavaa hintakäyrää.

Vertailuluvut ovat toistaiseksi yhtiön omia

Alibaban mukaan mallin keskimääräiset pisteet nousivat yli 25 prosenttia 29 arvioinnissa edeltäjään verrattuna. Agenttipainotteisissa testeissä nousu oli keskimäärin 19,5 pistettä. OmniVideoBenchissä tulos parani 63,4:stä 67,8:aan. Samalla testi vei aiempaa vähemmän tokeneita, joten tulos parani halvemmalla.

Yhtiö asettaa mallin vastakkain Googlen Gemini 3.8 Flashin kanssa. WildClawBench-MM-testissä Qwen sai 71,0 pistettä ja Gemini 58,9. SpotSoundBenchissä ero oli 67,2 vastaan 39,7. Puhtaassa videopäättelyssä AgenticVBench-testissä Qwen jää kilpailijastaan.

Kaikki luvut ovat Alibaban omasta julkaisumateriaalista. Riippumatonta arviointia ei ollut julkaistu kirjoitushetkellä. Kommentaattorit ovat huomauttaneet, että vertailut on valittu valikoiden ja että ne kannattaa lukea markkinointina siihen asti, kunnes ulkopuoliset toistavat mittaukset. Vahvistus on sitäkin tärkeämpi, koska osa käytetyistä vertailutesteistä on tuoreita eikä niiden tuloksia ole laajalti toistettu.

Kaksi samanlaista mittalaitetta vierekkäin laboratoriopöydällä, välissä työntömitta ja tyhjä tuloskortti.

Painot pysyvät kiinni, työkalut aukeavat

Qwen3.8-Omni-Flashille ei julkaistu avoimia painoja. Mallia voi ajaa vain Alibaban omalla infrastruktuurilla. Pohjana toimiva Qwen3.8-Flash-Next sai avoimet painot noin kuukausi elokuisen julkaisunsa jälkeen, mutta omnimallin osalta yhtiö ei ole luvannut vastaavaa. Ero on merkittävä, sillä Qwenin maine on rakentunut pitkälti avoimien painojen varaan.

Avoimeksi lähdekoodiksi menevät sen sijaan Qwen-MM-Plugins ja Qwen-Live Harness. Valinnainen MCP-palvelin tarjoaa multimodaaliset toiminnot kutsuttavina työkaluina Claude Codelle, Codexille ja Gemini CLI:lle. Julkaisu on siis kaksiosainen: suljettu malli ja avoin työkalukerros sen ympärillä. Kehittäjälle tämä tarkoittaa, että äänen ja videon käsittelyn voi liittää olemassa olevaan agenttiputkeen ilman erillistä integraatiota.

Alueellisesta saatavuudesta, kutsurajoista tai datan säilytyskäytännöistä Alibaba ei ole kertonut sen enempää kuin rajapintadokumentaatio paljastaa. Yrityskäytössä juuri nämä ratkaisevat käyttöönoton. Halpa tokeni ei auta, jos aineisto ei saa siirtyä toimittajan pilveen.

Suljettu musta kuutio lasivitriinissä, ympärillä vapaasti saatavilla avoimia moduuliosia ja liittimiä.

Yhteenveto

Qwen3.8-Omni-Flash on ennen kaikkea hintajulkaisu. Äänen ja videon käsittely halpeni kertaluokalla, ja samalla malli oppi käyttämään työkaluja. Yhdistelmä avaa käyttötapauksia, jotka aiemmin kaatuivat laskuun: tuntien mittaisten palaverien tiivistämisen, videoiden kääntämisen ja pitkien tallenteiden jäsentämisen raporteiksi.

Avoimet kysymykset koskevat lukujen kestävyyttä ja mallin saatavuutta. Riippumattomat mittaukset ratkaisevat, pitävätkö Gemini-vertailut kutinsa. Suljetut painot puolestaan sitovat käyttäjän Alibaban pilveen, mikä erottaa julkaisun yhtiön aiemmista avoimista malleista. Seuraavaksi nähdään, seuraavatko kilpailijat perässä hinnoittelussa.