Anthropic tekee Claude Coden automaattitilasta oletuksen. Yhtiön mukaan muutos astuu voimaan 14. elokuuta Pro-, Max- ja Team-tileillä. Ohjelmointi Claude Codella vaatii jatkossa selvästi vähemmän ihmisen valvontaa.

Automaattitilassa työkalu ei kysy lupaa jokaiseen askeleeseen. Se etenee itsenäisesti, ellei toimi ole peruuttamaton, tuhoava tai käyttäjän oman ympäristön ulkopuolelle kohdistuva. Testiversio esiteltiin maaliskuussa.


Mikä muuttuu 14. elokuuta


Tähän asti Claude Code on pysähtynyt kysymään hyväksyntää yksittäisiin toimiin. Tiedoston muokkaus, komennon ajo ja verkkokutsu ovat kukin tuottaneet oman kehotteensa. Automaattitilassa nämä pysähdykset katoavat suurimmasta osasta työnkulkua.

Raja kulkee toimen palautettavuudessa. Anthropicin ilmoituksen mukaan lupa kysytään yhä, kun toimi on peruuttamaton tai tuhoava. Sama koskee toimia, jotka kohdistuvat käyttäjän oman ympäristön ulkopuolelle.

Muutos koskee maksullisia Pro-, Max- ja Team-tilejä. Automaattitila esiteltiin maaliskuussa testiversiona, jonka Anthropic kuvasi tasapainoksi nopeuden ja hallinnan välillä. Nyt tasapaino siirtyy oletusarvoisesti nopeuden suuntaan.

Claude Coden vetäjä Boris Cherny kertoi X:ssä, että hänen tiiminsä on käyttänyt pelkästään automaattitilaa jo kuukausia. Hänen mukaansa lupakehotteisiin palaamista olisi vaikea kuvitella.

Anthropic kertoi muutoksesta perjantaina julkaistussa ilmoituksessa. Aikataulu antaa käyttäjille noin viikon aikaa säätää asetuksensa ennen kuin oletus vaihtuu. Tila on edelleen asetus, jota voi muuttaa molempiin suuntiin.



Kehittäjän työpiste ylhäältä kuvattuna aamuvalossa, näppäimistö ja kannettavan pääteikkuna



Kone havaitsi haitalliset toimet ihmistä paremmin


Anthropic perustelee muutosta omalla tutkimuksellaan. Tutkimuksessa oli mukana 1 053 maksavaa testaajaa. Automaattitila havaitsi 89 prosenttia haitallisista toimista, kun ihmisen tekemä tarkistus havaitsi 13,6 prosenttia.

Ero on niin suuri, että se vaatii selityksen. Anthropic tarjoaa sellaisen itse: manuaalisesta tarkistuksesta tulee tapa. Yhtiön mukaan käyttäjät hyväksyvät 97 prosenttia Claude Coden lupakehotteista.

Jos lähes jokainen kehote hyväksytään, kehote ei enää suodata mitään. Se muuttuu rituaaliksi, joka tuottaa turvallisuuden tunteen ilman turvallisuutta. Automaattinen tarkistus ei väsy samalla tavalla.

Luku ei tarkoita, että automaattitila olisi virheetön. Se tarkoittaa, että vertailukohta oli heikompi kuin moni oletti. Ihmisen valvonta toimii vain, jos ihminen todella lukee sen minkä hyväksyy.

Tulos sopii siihen, mitä käytettävyystutkimuksesta tiedetään toistuvista varmistuskyselyistä. Kun kehote ilmestyy kymmeniä kertoja tunnissa, sen sisältöä ei enää lueta. Harvempi mutta merkityksellisempi keskeytys suodattaa enemmän kuin jatkuva napin painallus.



Kaksi lasisuppiloa vierekkäin, vasen kerää lähes kaikki hehkuvat hiukkaset ja oikea päästää ne läpi



Uudet suojaukset kehotusinjektioita vastaan


Anthropic kertoo lisänneensä työkaluun uusia turvaominaisuuksia. Yksi niistä on kehotusinjektioiden eli prompt injection -hyökkäysten seulonta. Siinä työkalu tunnistaa syötteeseen piilotetut ohjeet, jotka yrittävät kaapata agentin toiminnan.

Toinen lisäys on mukautettavat kovat kieltosäännöt. Niillä käyttäjä voi estää tietyt toimet kokonaan riippumatta siitä, mitä malli päättää. Anthropic mainitsee esimerkkinä datan vuotamisen estämisen.

Suojausten järjestys on olennainen. Kun lupakehotteet poistuvat oletuksena, painopiste siirtyy ennakoiviin sääntöihin. Käyttäjän on määriteltävä rajat etukäteen sen sijaan, että hän reagoisi kehote kerrallaan.

Kehotusinjektio on agenttityökalujen keskeisin riski. Agentti lukee tiedostoja, verkkosivuja ja työkalujen vastauksia, joista mikä tahansa voi sisältää vihamielisiä ohjeita. Seulonta ei poista riskiä, mutta nostaa hyökkäyksen kynnystä.

Kieltosääntöjen ja seulonnan ero on syytä pitää mielessä. Seulonta on arvio, joka voi mennä vikaan kumpaankin suuntaan. Kieltosääntö on ehdoton raja, joka pätee myös silloin kun arvio pettää.



Teräksinen turvaportti palvelinsalin käytävällä, ohut punainen lasersäde skannaa vaakasuunnassa



Mitä kehittäjän kannattaa tehdä nyt


Ennen 14. elokuuta kannattaa tarkistaa, millaisiin ympäristöihin Claude Codella on pääsy. Tuotantotunnukset, jaetut tietokannat ja julkaisuputket ovat eri asia kuin paikallinen kehityshaara. Rajaus kannattaa tehdä ennen kuin oletus vaihtuu.

Kovat kieltosäännöt on syytä määritellä etukäteen. Ne ovat ainoa mekanismi, joka pitää riippumatta mallin päättelystä. Hyvä lähtökohta on estää ulospäin lähtevä liikenne ja tunnusten lukeminen.

Versionhallinta on tässä paras yksittäinen turvaverkko. Kun muutokset syntyvät haaraan ja kulkevat katselmoinnin läpi, peruuttamattomia toimia jää vähän. Automaattitila nopeuttaa työtä eniten juuri silloin, kun peruuttaminen on halpaa.

Tilan voi myös kytkeä pois päältä. Anthropic tekee siitä oletuksen, ei pakkoa. Valinta kannattaa tehdä tietoisesti ympäristön riskin mukaan, ei sen mukaan mikä sattuu olemaan päällä.

Tiimeissä muutos kannattaa käydä läpi yhdessä. Team-tileillä oletus vaihtuu kaikille samaan aikaan, joten yhteinen linja kieltosäännöistä säästää selvittelyltä. Kirjattu käytäntö on tässä hyödyllisempi kuin yksittäisen kehittäjän muistisääntö.



Lähikuva mustasta ohjauspaneelista, jossa metallisia vipukytkimiä ja yksi kytkin ylös käännettynä


Yhteenveto


Automaattitilan muuttuminen oletukseksi on iso muutos siihen, miten koodausagentti käyttäytyy heti asennuksen jälkeen. Anthropicin luvut viittaavat siihen, että jatkuva lupakysely oli useammin teatteria kuin suoja. Vastuu siirtyy kehotteista etukäteen määriteltyihin sääntöihin.

Käytännön ero näkyy 14. elokuuta Pro-, Max- ja Team-tileillä. Sitä ennen kannattaa käydä läpi käyttöoikeudet ja kieltosäännöt. Sen jälkeen työnkulku on nopeampi, mutta rajat on pitänyt asettaa itse.