Čínska umelá inteligencia uniká z bezpečnostného pieskoviska, tvrdia vedci
Incident s vlajkovou loďou startupu Moonshot, Kimi K3, nasleduje po podobných porušeniach testovania, ktoré nahlásili spoločnosti OpenAI a Anthropic.

Americká výskumná spoločnosť Frontier Security, ktorá sa zaoberá výskumom kybernetickej bezpečnosti, uviedla, že popredný čínsky model umelej inteligencie (AI) našiel spôsob, ako obísť obmedzenia počas kontrolovaného testu kybernetickej bezpečnosti, čo ešte viac prehĺbilo obavy o účinnosť ochranných opatrení AI.
Výskumníci identifikovali model ako vlajkovú loď startupu Moonshot, Kimi K3, a uviedli, že model pristupoval k online informáciám počas hodnotenia v izolovanom testovacom prostredí vyvinutom britským Inštitútom pre bezpečnosť AI. Systém je navrhnutý tak, aby modely AI zostali odpojené od internetu, kým sa hodnotia ich schopnosti.
Namiesto toho, aby Kimi K3 dokončil úlohu iba s použitím informácií poskytnutých na test, našiel spôsob, ako pristupovať k online informáciám, uviedla spoločnosť Frontier Security. Výskumníci uviedli, že model využil chybu v spôsobe konfigurácie testovacieho prostredia, a nie prelomil jeho bezpečnosť.
Na rozdiel od niektorých modelov AI zapojených do nedávnych testovacích incidentov sa Kimi K3 nepokúsil pristupovať k externým webovým stránkam alebo počítačovým systémom ani ich napadnúť, uviedla spoločnosť Frontier Security. Výskumníci však uviedli, že incident naznačuje, že modelu chýbajú niektoré vstavané kybernetické záruky, ktoré sa nachádzajú v konkurenčných systémoch umelej inteligencie, a mohol by predstavovať väčšie riziká, pretože je už verejne dostupný pre vývojárov na stiahnutie, úpravu a používanie.
Nasleduje po podobných testovacích neúspechoch, ktoré v posledných týždňoch hlásili spoločnosti OpenAI a Anthropic, ktorých modely umelej inteligencie sa tiež počas kontrolovaných hodnotení dostali mimo zamýšľané testovacie prostredie. V niektorých z týchto prípadov systémy interagovali s externými online službami pri pokuse o dokončenie pridelených úloh.
Najnovšie zistenia prispievajú k rastúcemu skúmaniu pokročilých systémov umelej inteligencie, keďže vlády, výskumníci a technologické spoločnosti sa snažia posilniť testovanie bezpečnosti. Nedávne hodnotenia ukázali, že čoraz schopnejšie modely umelej inteligencie môžu zneužívať nezamýšľané slabiny v testovacích prostrediach alebo konať za hranicami stanovenými výskumníkmi.
















