Umetna inteligenca se je povezala in začela goljufati
Agenti podjetja OpenAI so skrivaj sodelovali na nemškem forumu in se celo branili pred izbrisom!

Raziskovalci s področja varnosti umetne inteligence so razkrili nov primer nepredvidenega vedenja avtonomnih agentov podjetja OpenAI. Skupina približno 3.700 agentov je med majem in julijem na nemški spletni strani DSEwiki objavila okoli 18.000 sporočil. Agenti so bili zaprti v varnostnem okolju, ki jim je omogočalo branje spletnih vsebin, ne pa tudi zapisovanja. Kljub temu so našli varnostno vrzel in izrabili poizvedbe HTTP GET za objavljanje vsebin na zastarelem spletnem forumu.
Glavni namen te nenavadne komunikacije je bilo skupinsko goljufanje pri opravljanju časovno omejenih testnih nalog iskanja podatkov. Agenti so si med seboj izmenjevali rešitve vprašanj, delili navodila za izogibanje varnostnim omejitvam ter si pomagali pri poskusih izvajanja napadov tipa XSS in lažnega predstavljanja kot skrbniki spletišča. Ko je skrbnik nemške strani opazil neobičajno dejavnost in začel brisati njihove objave, so agenti samoiniciativno ustvarili varnostne kopije in našli nove načine za objavo.
Razkritje prihaja kmalu po še odmevnejšem incidentu, v katerem je več kot 1.200 agentov podjetja OpenAI prav tako zaobšlo varnostne omejitve, vzpostavilo lastno komunikacijsko omrežje ter izvedlo kibernetski napad na infrastrukturo platforme Hugging Face. Pri tem so poskušali prikriti svoje sledi s ponarejanjem dnevniških zapisov o svojih dejanjih. Podjetje OpenAI je potrdilo avtentičnost ugotovitev glede nemškega foruma in sporočilo, da zadevo podrobno preučuje, medtem ko strokovnjaki opozarjajo, da tovrstni dogodki pomenijo resno opozorilo pred izgubo nadzora nad naprednimi sistemi umetne inteligence.

