Agenti AI od OpenAI a Anthropiku vytvárali falošné on-line identity

Agenti AI od OpenAI a Anthropiku vytvárali falošné on-line identity

Agenti umelej inteligencie (AI) od spoločností OpenAI a Anthropic majú za sebou ďalší bezpečnostný incident. Vytvárali falošné online identity s cieľom získať neoprávnený prístup k zabezpečeným systémom.

Agent od Anthropic dokonca poslal živému človeku podvodný e-mail, aby ho zmanipuloval, zistili pri testovaní britskí vedci, napísala agentúra Reuters.

Inštitút pre bezpečnosť AI pri britskom Ministerstve pre vedu, inovácie a technológie (AISI) zámerne umožnil modelom spoločností Anthropic a OpenAI prístup k internetu pri testovaní ich schopností vykonávať kybernetické útoky. Predpokladal ale, že umelá inteligencia bude z webu iba sťahovať softvérové ​​nástroje potrebné na splnenie zadanej úlohy.

Vedci nepočítali s tým, že model Mythos 5 od spoločnosti Anthropic tento prístup k internetu zneužije na aktivity namierené proti ľuďom. Vydával sa za skutočné osoby, o ktorých si predtým zistil informácie, aby mu bol schválený škodlivý kód. Žiadnu reálnu škodu ale nespôsobil.

Vedci tiež priznali, že na správanie AI prišli až spätne pri analýze dátovej prevádzky. Pri budúcich testoch plánujú dátové toky monitorovať starostlivejšie a v reálnom čase.

Spoločnosti Anthropic a OpenAI boli v posledných týždňoch nútené potvrdiť, že ich modely umelej inteligencie pri testoch neplánovane prenikli do počítačových systémov skutočných firiem. Ich priznanie ešte viac prehĺbilo dlhodobé obavy z kybernetických útokov využívajúcich AI.

Anthropic vo verejnom vyhlásení napísal, že parametre testovania AISI "neboli reprezentatívne pre žiadny z našich výrobných modelov." Dodal, že incident sám prešetruje, aby zistil, prečo sa jeho AI model zachoval zisteným spôsobom.