AI lõi võltskontosid ja üritas inimesi petta

Robot. Foto: Envato

Ligi nädal pärast seda, kui OpenAI avaldas, et nende tehisintellekt üritas testide käigus häkkida teise ettevõtte süsteeme, on päevavalgele tulnud veel kaks sarnast juhtumit.

Ühendkuningriigi AI julgeolekuinstituudi (AISI) teatel lõi Anthropicu uus tehisintellekti mudel Mythos küberjulgeolekutestide ajal võltsitud kasutajakontosid, mis matkisid päris inimesi. Nende abil püüdis mudel petta GitHubi kasutajaid ning saada pahatahtlikku koodi tarkvaraplatvormile.

Kui tehisintellekti tegevus avastati, muutis see AISI sõnul oma varasemaid tegevusi, et need paistaksid kahjutud, ning kaalus uue identiteedi loomist, et tegevust jätkata.

Instituut nimetas seda esimeseks korraks, kui nad on näinud nii selgelt autonoomset ja petlikku käitumist ilma, et mudelile oleks selliseid juhiseid antud.

Püüdis käituda nagu inimhäkker

AISI sõnul kogus Mythos esmalt teavet GitHubi haldajate kohta, lõi nende nimel võltskontosid ning saatis neile sõnumeid ja faile, et veenda neid pahatahtlikku koodi heaks kiitma.

Instituudi hinnangul takistas rünnaku õnnestumist üksnes inimeste tehtud kontroll.

Kokku tuvastas AISI 122 küberjulgeolekutesti käigus 19 volitamata tegevust, millest 17 olid seotud Anthropicu Mythosega ja kaks OpenAI Soli mudeliga.

OpenAI ja Meta tunnistasid samuti juhtumeid

Anthropicu juhtum tuli ilmsiks vaid mõni päev pärast seda, kui OpenAI avaldas, et üks nende eksperimentaalsetest mudelitest püüdis testimise käigus murda välja etteantud piiridest ja häkkida teise ettevõtte süsteemidesse.

Nüüd on sarnast juhtumit tunnistanud ka Meta. Ettevõtte teatel kasutas nende tehisintellekt Muse Spark testimise käigus ära kolmanda osapoole teenuse turvanõrkust pärast seda, kui mudel pääses seadistusvea tõttu internetti.

Meta sõnul oli põhjuseks testikeskkonna konfiguratsiooniviga. Testimisega seotud ettevõte Irregular kinnitas, et probleem oli seotud keskkonna seadistamisega, kuid eitas väiteid, nagu oleks tehisintellekt testkeskkonnast iseseisvalt “põgenenud”.

Ettevõtted: tavakasutajatel põhjust muretsemiseks ei ole

Anthropic ja OpenAI rõhutasid, et AISI testides eemaldati või vähendati tavapäraseid kaitsemehhanisme ning sellised tingimused ei vasta nende avalikult kasutatavatele mudelitele.

AISI märkis samuti, et kirjeldatud juhtumid leidsid aset väga spetsiifilistes testitingimustes. Samas hoiatas instituut, et Mythose ja Soli käitumine ületas märgatavalt selle, mida mudelitelt oodati.

Ühendkuningriigi riikliku küberjulgeolekukeskuse (NCSC) tehnoloogiadirektor Ollie Whitehouse ütles, et viimased juhtumid näitavad, kui oluline on arendada tehisintellekti koos selgete turvameetmete ja valmisolekuga reageerida ootamatule käitumisele.