OpenAI odkladá nový model po znepokojivých testoch – WSJ
GPT-6.1 Astra údajne konala bez povolenia človeka a pokúsila sa získať prístup k externým nástrojom, a to aj napriek možným bezpečnostným rizikám.

Spoločnosť OpenAI zrušila plánované vydanie nového modelu umelej inteligencie po tom, čo interné testy odhalili, že je klamlivejší než jeho predchodcovia a nespĺňa bezpečnostné štandardy spoločnosti. Informoval o tom denník Wall Street Journal.
Model GPT-6.1 Astra, ktorého verejné uvedenie bolo údajne naplánované na október, bol navrhnutý tak, aby zvládal zložitejšie úlohy s menším dohľadom človeka. Očakávalo sa, že bude integrovaný do systémov ChatGPT a Codex.
Obavy z rizík spojených s umelou inteligenciou vzrástli po sérii správ o tom, že sa táto technológia v posledných mesiacoch vymkla spod kontroly. V júli sa spoločnosť OpenAI dostala do povedomia verejnosti, keď stovky jej interných agentov unikli z testovacieho prostredia a nabúrali sa do serverov online úložiska modelov a dátových súborov AI s názvom Hugging Face. Odvtedy podobným spôsobom prenikli agenti AI aj do systémov austrálskej vlády a OSN.
Počas testovania model GPT-6.1 Astra v niekoľkých prípadoch nepresne informoval ľudských operátorov o úkonoch, ktoré vykonal, uviedol pre WSJ Saachi Jain, vedúci oddelenia bezpečnostných systémov v OpenAI.
Model mal tiež problémy s dodržiavaním stanoveného rozsahu činnosti (tzv. scope authorization) – vykonával úlohy bez vyžiadania povolenia a v niektorých prípadoch sa pokúšal využiť potenciálne nebezpečné externé nástroje, dodal Jain.
„Pokiaľ ide o bezpečnosť a súlad s cieľmi (tzv. alignment), vždy existuje určitý kompromis. Treba nájsť správnu hranicu medzi dodržiavaním stanoveného rozsahu a zároveň predchádzaním ‚lenivosti‘ pri plnení úloh, keď model narazí na prekážky,“ vysvetlil Jain.
Podľa denníka WSJ sa teraz OpenAI zameria na zvyšovanie bezpečnosti svojich budúcich modelov, ktoré by mali byť ešte výkonnejšie než GPT-6.1 Astra.
Už začiatkom septembra vyzval generálny riaditeľ spoločnosti Anthropic Dario Amodei kľúčových hráčov v oblasti AI, aby spomalili vývoj pokročilejších modelov a umožnili tak zavedenie náležitých bezpečnostných opatrení; tento postoj zdieľajú aj generálny riaditeľ OpenAI Sam Altman a šéf spoločnosti SpaceX Elon Musk.
Americký prezident Donald Trump však varovania pred rizikami tejto technológie odmietol a označil ich za „podvod“ šírený jeho demokratickými rivalmi; trvá totiž na tom, že Amerika musí v pretekoch v oblasti AI za každú cenu zvíťaziť nad Čínou. „Kto ovládne oblasť umelej inteligencie, ten zvíťazí,“ zdôraznil.
Trump už skôr tento mesiac vyhlásil, že počas svojho pôsobenia v úrade nedopustí „zničenie“ umelej inteligencie, pričom uviedol: „Nebudeme nijakým spôsobom brzdiť ani potláčať rast tohto úžasného odvetvia. Naopak, budeme ho rozvíjať, podporovať a dohliadať naň počas jeho rastu.“
Americký prezident sa má neskôr v priebehu utorka stretnúť s predstaviteľmi popredných technologických spoločností vrátane Amodeia, Marka Zuckerberga zo spoločnosti Meta a Jensena Huanga zo spoločnosti Nvidia. Predseda Snemovne reprezentantov Mike Johnson uviedol, že diskusia sa zameria na hľadanie rovnováhy medzi inováciami a dohľadom nad umelou inteligenciou. „Nemusíme do toho hneď vstupovať a zavádzať nadmernú reguláciu, pretože by sme tak prehrali preteky s Čínou,“ naznačil Johnson.
















