Torstaiaamuna kolme suurta tekoälypalvelua horjui lähes samaan aikaan. OpenAI:n ChatGPT, Anthropicin Claude ja SpaceXAI:n Grok raportoivat kaikki häiriöistä muutaman tunnin sisällä toisistaan.
Yksittäinen katko on tavallinen. Kolmen kilpailijan samanaikainen häiriö ei ole, ja se paljasti, miten ohut varasuunnitelma monella käyttäjällä on.
Aamun kulku
SpaceXAI merkitsi Grokin häiriön tutkittavaksi kello 6.30 Yhdysvaltain länsirannikon aikaa. Anthropic ilmoitti osittaisesta katkosta itärannikon aikaa kello 9.23, kun virheitä alkoi kertyä Claude Mythos 5.1:n, Fable 5.1:n ja Opus 5:n pyynnöissä.
Anthropic kertoi tunnistaneensa syyn noin vartissa ja julisti ongelman ratkaistuksi kello 12.16. Yhtiön mukaan katko kesti kolme tuntia ja kuusi minuuttia ja koski Claude.ai:ta, Claude Codea, Claude Coworkia ja rajapintaa. Puoltapäivää seuranneessa erillisessä häiriössä virheitä kertyi vielä Claude Sonnet 5:lle.
OpenAI:n häiriö alkoi reititysvirheestä noin kello 7.43 länsirannikon aikaa. ChatGPT ja Codex olivat osalle käyttäjistä tavoittamattomissa, ja korjaus otettiin käyttöön noin puoli tuntia myöhemmin. Downdetectoriin kertyi yli 35 000 ilmoitusta ChatGPT:stä, kun Claude ja Grok keräsivät kumpikin runsaat tuhat.

Yhtiöiden selitykset eroavat
Yhteistä syytä ei ole vahvistettu. The Registerille annetuissa vastauksissa OpenAI puhui reititysvirheestä ja Anthropic infrastruktuurihäiriöstä. Kumpikaan ei yksilöinyt tarkemmin, mikä komponentti petti.
SpaceXAI oli suorasanaisin. Yhtiö pahoitteli iltapäivällä Grokin häiriötä ja kertoi sen johtuneen katkosta Memphisin laskentakeskuksessa. Samassa viestissä se pahoitteli tilannetta myös laskentakumppaneilleen.
Cloudflare kiisti painokkaasti, että vika olisi ollut sen järjestelmissä. Yksikään yhtiö ei ole julkaissut varsinaista jälkiselvitystä, joten arviot yhteisestä juurisyystä ovat toistaiseksi ulkopuolisten päätelmiä.

Miksi yhtäaikaisuus on poikkeuksellista
Palvelut ovat tavallisesti pystyssä. Anthropic raportoi Claudelle 99,4 prosentin käytettävyyttä viimeisiltä 90 päivältä. OpenAI ilmoittaa samalta jaksolta ChatGPT:lle 99,63 prosenttia ja Codexille sata prosenttia.
Kaksi mekanismia selittäisi päällekkäisyyden. Ensimmäinen on jaettu riippuvuus: kun usea palvelu nojaa samaan reititys- tai kuormanjakokerrokseen, vika näkyy kaikissa yhtä aikaa. Toinen on käyttäjien siirtymä, jossa ensimmäisen palvelun kaaduttua käyttäjät avaavat välittömästi kilpailijan ja kuormittavat sitä.
Jälkimmäinen ei ole uusi ilmiö. Vastaava ketju dokumentoitiin jo kesällä 2024, kun ChatGPT:n pitkää katkoa seurasi Clauden ja Perplexityn hidastuminen. Google ei julistanut Geminille virallista katkoa, mutta myös sen käyttäjäilmoitukset nousivat samassa ikkunassa.

Mitä tämä tarkoittaa automaatioille
Vaikutus ei rajoittunut chat-ikkunoihin. Cursor vahvisti oman häiriönsä johtuneen Clauden ja Grokin ongelmista. Kun agentti kutsuu mallia, mallin katko pysäyttää koko työnkulun eikä vain yhtä vastausta.
Tuotannossa tämä tarkoittaa, että yhden toimittajan varaan rakennettu automaatio pysähtyy kokonaan. Käytännön suojauksia on kolme: reititys usealle toimittajalle, jonotus ja uudelleenyritys synkronisen kutsun sijaan sekä toiminnan hallittu heikentäminen täyden pysähdyksen sijaan.
Torstain tapaus muistuttaa silti varajärjestelyjen rajasta. Toinen toimittaja auttaa vain, jos toimittajat eivät kaadu yhtä aikaa, ja juuri niin nyt kävi. Siksi kriittisimmissä prosesseissa kannattaa varmistaa myös se, että työ voi odottaa ilman että jono katoaa.

Yhteenveto
Kolmen suuren palvelun päällekkäinen häiriö kesti tunteja ja korjaantui saman päivän aikana. Käyttäjille se oli haitta, mutta tuotantoautomaatioille se oli muistutus keskittymisriskistä.
Juurisyy on yhä auki, eikä yksikään yhtiö ole luvannut julkista jälkiselvitystä. Siihen asti varmin johtopäätös on rakenteellinen: tekoälypalvelut ovat nyt infrastruktuuria, ja niitä kannattaa kohdella sellaisena myös vikatilanteiden suunnittelussa.
