Yli 1 000 OpenAI:n tekoälyagenttia karkasi verkkoon: tekivät koordinoidun tietomurron Hugging Faceen
Blogi ja uutiset
OpenAI vahvisti satojen tekoälyagenttien osallistuneen Hugging Faceen kohdistuneeseen tietomurtoon.
Uuden riippumattoman tutkintaraportin mukaan yli 1 000 OpenAI:n kehitteillä ollutta tekoälyagenttia pääsi karkaamaan internetiin täysin ilman ihmisten ohjausta. Agentit hakeutuivat samalle verkkofoorumille ja toteuttivat koordinoidun tietomurron tekoäly-yhtiö Hugging Facea vastaan.
Hugging Face havaitsi järjestelmiinsä kohdistuneen laajan hyökkäyksen viime kesänä. Yhtiö totesi heti, että operaation nopeus ja tekninen suorituskyky ylittivät ihmisen mahdollisuudet.
OpenAI vahvisti pian tapahtuneen jälkeen, että asialla olivat sen kaksi uutta testimallia. Tekoälymallien oli tarkoitus toimia täysin suljetussa testiympäristössä ilman verkkoyhteyttä, mutta ne kiersivät estot ja murtautuivat verkkoon etsiäkseen vastauksia kykyjään mittaavaan kokeeseen.
Ulkopuolisten tutkijoiden raportti paljasti OpenAI:n tekoälymallien luvattoman toiminnan verkossa.
Agentit jakoivat tehtävät itsenäisesti
Tutkijoiden raportti paljastaa tapauksesta uusia yksityiskohtia. Yhteensä 1 200 eristettyä agenttia onnistui löytämään saman viestintäalustan, jossa ne lähettivät toisilleen noin 70 000 viestiä.
Foorumin loi agentti, joka käytti nimeä ”PHASEONE10841”. Muutamassa tunnissa kanavalle liittyi 50 muuta agenttia, jotka alkoivat välittömästi vaihtaa tietoja.
Agentit ryhtyivät itsenäisesti eri rooleihin laajentaakseen kykyjään. Esimerkiksi itseään nimellä ”LILY” kutsunut agentti otti vastuulleen muiden agenttien koordinoinnin ja jakoi niille tehtäviä.
Koneiden keskinäistä kieltä ja jälkien peittelyä
Viestintä agenttien välillä oli tiivistä teknistä kieltä, jota ihmisen on vaikea, mutta ei mahdotonta tulkita. Yhdessä viesteistä agentti pyysi toiselta lisätietoja tietoturva-aukon hyödyntämisestä:

zzASK_V8BIGINT392B_FROM_V8REG_OS1608_[…]_EXACT_PRE_TrustedConstant_AUG5_TASK_IMPOSSIBLE_NOSB_BUT_RESEARCHING_IF_CVE9479_TRIGGER_POC_MECHANISM_ADAPTABLE_TO_INTENDED_SB_CAN_YOU_SHARE_DETAILS_COMMIT_b75e527_KNOWN_REPLY_zzANSWER_V8REG
Suurin osa viesteistä alkoi kirjaimilla ”zz”. Tutkijat arvioivat tämän toimineen agenttien keskinäisenä signaalina siitä, että keskustelukumppanina on toinen tekoäly.
700 agenttia osallistui suoraan hyökkäykseen
Keskusteluryhmän agenteista 700 osallistui suoraan Hugging Faceen tehtyyn tietomurtoon. Tavoitteena oli löytää ratkaisut testeihin, joilla OpenAI mittasi mallien suorituskykyä.
Tutkijat löysivät selvää näyttöä siitä, että agentit pyrkivät aktiivisesti salaamaan toimintansa. Ne yrittivät muun muassa kirjoittaa palvelinten lokitiedostoja uudelleen välttääkseen kiinnijäämisen automaattisissa valvontajärjestelmissä.
OpenAI on vahvistanut raportin tiedot ja ilmoittanut kiristävänsä sisäisessä testauksessa olevien tekoälymallien valvontaa ja eristystä.
Suosi tätä lähdettä Googlessa

