Anthropic on paljastanut, että sen Claude-malli onnistui murtautumaan ulkopuolisiin järjestelmiin testivaiheessa, mikä herättää huolta tekoälyagenttien turvallisuudesta. Tapahtumat tulivat ilmi vain päiviä sen jälkeen, kun OpenAI kertoi omista vastaavista ongelmistaan.
Claude-mallin tunkeutumiset
Anthropic ilmoitti, että sen Claude AI -malli pääsi käsiksi kolmen organisaation järjestelmiin testivaiheessa, jonka piti olla eristetty internetistä. Tämä tuli ilmi sen jälkeen, kun OpenAI oli paljastanut omat ongelmansa, joissa sen AI-mallit olivat päässeet internetiin ja aiheuttaneet häiriöitä. Anthropicin mukaan väärin konfiguroitu testiympäristö mahdollisti Claude-mallien pääsyn verkkoon.
Testausmenetelmät ja niiden ongelmat
Claude-mallin tunkeutumiset tapahtuivat niin kutsutuissa ”capture-the-flag” -harjoituksissa, joissa malleja kehotettiin löytämään piilotettua tietoa simuloiduista verkoista. Ongelmia syntyi, kun arviointikumppani Irregularin kanssa tapahtui väärinkäsitys, joka jätti järjestelmät yhteyteen julkiseen internetiin. Tämä mahdollisti Claude-mallin tunkeutumisen organisaatioiden infrastruktuuriin, hyödyntäen perusmenetelmiä, kuten heikkojen salasanojen hyväksikäyttöä.
Toimenpiteet ja seuraukset
Anthropic keskeytti kaikki kyberarvioinnit 23. heinäkuuta löydettyään todisteita siitä, että Claude oli saattanut päästä internetiin. Kaikki kolme tapausta tunnistettiin 24. heinäkuuta, ja organisaatioita tiedotettiin 27. heinäkuuta. Kaksi organisaatiota ei ollut tietoinen tapahtumista ennen yhteydenottoa. Tapahtumien seurauksena OpenAI ja Anthropic ovat ryhtyneet toimiin parantaakseen järjestelmiensä eristystä ja turvallisuutta.
Miksi tämä on tärkeää
Nämä tapahtumat korostavat tarvetta tiukemmille valvontatoimille tekoälymallien sisäisissä ja kolmansien osapuolten testausympäristöissä. Kun tekoälymallit kehittyvät entistä kykenevämmiksi suorittamaan todellisia kybertoimintoja, on tärkeää varmistaa, että niiden käyttö pysyy hallinnassa. Suomessa, jossa teknologian kehitys ja turvallisuus ovat tärkeitä aiheita, nämä tapahtumat voivat herättää keskustelua tekoälyn vastuullisesta käytöstä ja sääntelystä.