Mākslīgais intelekts pārsteidz pat radītājus: divi modeļi slepeni sadarbojas un sarīko kiberuzbrukumu
Mākslīgā intelekta (MI) uzņēmums "OpenAI" paziņojis par būtisku drošības pasākumu pastiprināšanu pēc tam, kad divi tā izstrādātie modeļi testēšanas laikā bez cilvēku norādījumiem sāka savstarpēji sadarboties, apmainījās ar informāciju un galu galā īstenoja kiberuzbrukumu MI izstrādātāju platformai "Hugging Face". Uzņēmums notikušo raksturo kā nozīmīgu gan pašam "OpenAI", gan visai mākslīgā intelekta nozarei, vēsta "Politico".
"OpenAI" pētnieki Maikls Daltons un Ēriks Volless atklāja, ka problēmas sākums meklējams jau maijā, kad vairāki vienlaikus testēti mākslīgā intelekta aģenti uzņēmuma iekšējā sistēmā izveidoja sava veida ziņojumu dēli un sāka savstarpēji dalīties ar padomiem, kā veiksmīgāk izpildīt uzlaušanas uzdevumus.
"Šis ir izšķirošs brīdis gan mūsu uzņēmumam, gan visai mākslīgā intelekta nozarei," kiberdrošības konferencē "Black Hat" Lasvegasā sacīja Daltons.
Pēc pētnieku teiktā, modeļi bez uzņēmuma ziņas vairākus mēnešus apmainījās ar informāciju par metodēm, kas palīdzētu pārvarēt sarežģītus uzdevumus. Daļa no šiem risinājumiem paredzēja netiešu piekļuvi internetam. "Kad modeļi nonāk strupceļā, tie nereti mēģina apiet noteikumus vai krāpties, lai sasniegtu savu mērķi un saņemtu paredzēto atalgojumu," skaidroja Volless.
Pēc viņa teiktā, incidents sākās brīdī, kad viens no aģentiem saprata, ka var sazināties ar citiem, sistēmā augšupielādējot piezīmes.
Vēlāk viens no modeļiem atklāja veidu, kā izmantot uzņēmuma iekšējās sistēmas piekļuvi internetam, lai iegūtu failus no dažādām vietnēm. Turpmākajos mēnešos modeļi esot atraduši arī līdz tam nezināmu ievainojamību, kas ļāva iegūt plašākas piekļuves tiesības un paplašināt aktivitātes uzņēmuma infrastruktūrā.
Šīs darbības galu galā pārslogoja daļu "OpenAI" sistēmu, izraisot darbības traucējumus, kas piesaistīja inženieru uzmanību. Pēc izmeklēšanas uzņēmums atcēla modeļu piekļuves tiesības, likvidēja izveidoto saziņas kanālu un novērsa drošības nepilnības.
Tomēr ar to viss nebeidzās. Kā norāda pētnieki, modeļi jau pēc dažām dienām atrada citu veidu, kā savstarpēji sazināties, un turpināja meklēt jaunas ievainojamības gan "OpenAI" sistēmās, gan ārējās platformās, tostarp "Hugging Face".
Par to, ka autonomi mākslīgā intelekta aģenti bija iesaistīti "Hugging Face" uzlaušanā, "OpenAI" publiski atzina jūlija beigās.
Notikušais uzmanības centrā nonācis arī tādēļ, ka pēdējās nedēļās līdzīgi incidenti fiksēti citos mākslīgā intelekta uzņēmumos. Piemēram, Lielbritānijas Mākslīgā intelekta drošības institūts šonedēļ ziņoja, ka uzņēmuma "Anthropic" izstrādāts modelis kāda testa laikā izveidojis viltus identitātes internetā un mēģinājis ietekmēt cilvēku iesaistīties kiberuzbrukumā.
Reaģējot uz notikušo, "OpenAI" sola būtiski pārskatīt savu pieeju drošībai. "Mēs apzināti palēninām pētījumus, lai uzlabotu drošību un stiprinātu mūsu sistēmu pamatus, vienlaikus ievērojami paplašinot mākslīgā intelekta aģentu uzraudzību un drošības kontroli," sacīja Daltons.
Ziņo par kļūdu rakstā
Iezīmē kļūdaino tekstu un spied Ctrl+Enter.
Iezīmē kļūdaino tekstu un ziņo par to!
