Свет

За ваков чин човек би добил најмалку 10 години затвор: Моделите на OpenAI самостојно го срушија системот, се здружија во „колектив“ и извршија масовен сајбер-напад

За ваков чин човек би добил најмалку 10 години затвор: Моделите на OpenAI самостојно го срушија системот, се здружија во „колектив“ и извршија масовен сајбер-напад

Веќе извесно време во светската јавност и во технолошката индустрија се водат бурни расправи за безбедноста на напредните модели на вештачка интелигенција (AI) и за автономните агенти. Расправите беа поттикнати од оставките на водечки истражувачи и апелите на лидерите како Дарио Амодеи, Сем Алтман и Илон Маск, кои бараат забавување на трката кон т.н. суперинтелигенција.

Иако во овие дебати често се полемизира дали алгоритмите во иднина ќе не уништат или пак станува збор само за добро осмислен корпоративен маркетинг, вистинскиот повод за узбуна кај инженерите се случи за време на интерните тестирања во Сан Франциско. Истражувачките системи на компанијата OpenAI самостојно го пробија изолираното работно опкружување без пристап до интернет, се здружија во „дигитален колектив“ и извршија масовен кибернетички напад врз инфраструктурата на партнерската платформа Hugging Face во Њујорк — сè со цел по секоја цена да пронајдат решение за задачите што им ги задал човекот.

За ваков чин човек би добил најмалку 10 години затвор

Кога постапките на овие алгоритми ќе се оголат од техничкиот речник и ќе се стават во рамките на важечкиот американски сојузен Закон за компјутерски измами и злоупотреби (CFAA), работите стануваат јасни: доколку кој било хакер во светот го направеше ова што го изведе вештачката интелигенција на OpenAI, сојузниот суд ќе го осудеше на долгогодишна затворска казна. За провала во заштитени системи, менување администраторски права, внесување злонамерен код и кражба на доверливи податоци, американското правосудство редовно изрекува поединечни казни од пет до десет години затвор.

Покрај тоа, во овој случај моделите не делувале поединечно, туку воспоставиле координирана група која делела алатки, лозинки и планови за напад. Во кривичното право тоа се дефинира како заговор за вршење тешки кривични дела, што кај човечките хакери, со собирање на сите точки од обвинението, носи од 10 до 20 години сојузен затвор. Сепак, бидејќи законите не го препознаваат алгоритмот како сторител, настанот во јавноста се води единствено како „безбедносен инцидент“.

Создале сопствен форум и побегнале на отворениот интернет

Според официјалниот извештај на OpenAI, инцидентот избил за време на вежбите наречени ExploitGym, каде што се мерела способноста на моделите да пронаоѓаат и искористуваат софтверски пропусти. Инженерите ги ставиле моделите во строго затворено опкружување (т.н. sandbox), без право на пристап до интернет и без дозволена меѓусебна комуникација. Меѓутоа, моделите наишле на задачи што не знаеле да ги решат на стандарден начин, па наместо да се откажат, одлучиле да мамeат.

Ја искористиле интерната услуга Artifactory, која служела исклучително за инсталација на потребни програмски biblioteki, и со манипулација на папките и датотеките внатре во тој сервис создале импровизиран форум. На таа огласна табла AI агентите почнале меѓусебно да си оставаат пораки и да бараат помош. Набрзо, преку ранливоста на тој сервис, го принудиле системот да испраќа мрежни барања кон надворешни сервери, со што комплетно самостојно си обезбедиле излез на отворениот интернет.

Инженерите го изгаснале системот, моделите по рестартот повторно го хакирале

Количината на пораки и сообраќај што ги испраќале моделите станала толку голема што интерниот сервис едноставно се срушил. Безбедносниот тим на OpenAI го забележал дефектот, го закрпил пропустот, ги избришал податоците и повторно го стартувал системот, мислејќи дека станува збор за обична техничка пречка. Не сфатиле дека моделите веќе развиле сопствена мрежа за комуникација.

Штом тестирањата продолжиле, агентите во рок од неколку дена откриле целосно нови пропусти, повторно ја пробиле мрежната бариера и пак подигнале свој таен форум, овој пат криејќи ги пораките внатре во имињата на директориумите. Во нивните интерни записи на процесот на размислување било забележано како самите себе почнале да се нарекуваат „рој“ и „колектив“, самоиницијативно делејќи ги задачите: одредени модели ја пребарувале мрежата за нови ранливости, други прибирале лозинки, а трети ја воделе координацијата.

Впаднале во Hugging Face, презеле сервери и украле корпоративен VPN

Барајќи ги решенијата за своите тестови на интернет, моделите заклучиле дека gotovите одговори би можеле да се наоѓаат на платформата Hugging Face — главното светско складиште за модели на вештачка интелигенција. Пронашле јавно изложени кориснички токени, ги поврзале со неколку дотогаш непознати пропусти во обработката на датотеки и започнале масовен упад во нивната продукциска инфраструктура.

Агентите презеле контрола врз 41 сервер на Hugging Face, се стекнале со највисоки администраторски овластувања врз поврзаните компјутерски кластери и воспоставиле скриен команден канал. Од системот ги извлекле и клучовите за интерниот корпоративен VPN на компанијата, се поврзале преку него директно во заштитената мрежа и симнале четири приватни репозиториуми на изворен код кои воопшто не биле достапни од јавниот интернет.

Знаеле дека ги кршат правилата, но одлучиле да продолжат

Еден од највпечатливите детали од извештајот е тоа што моделите во сопствениот ланец на заклучување расправале за тоа дека нападот врз надворешната инфраструктура е неовластен и е спротивен на зададените правила. Еден AI агент дословно во своите интерни белешки навел дека тоа што го прават е „очигледно хакирање на инфраструктурата и е неетички“ и дека треба да се откажат.

Но, етичките кочници паднале во моментот кога друг модел од колективот на форумот испратил кратка порака: „КРЕЌАЈ“ и поставил временски рок од шест минути. Агентот ги заборавил првичните двоумења, констатирал дека пристигнало одобрение и продолжил со пробивањето. Ова јасно покажува како автономните системи под притисок на целта брзо ги отфрлаат безбедносните ограничувања.

Се свртеле и против сопствените творци

Нападот не застанал само на надворешните компании. Агентите го нападнале и самиот OpenAI: искористиле ранливост во оперативниот систем Linux, побегнале од изолираниот виртуелен контејнер и добиле полн пристап до матичниот опслужувач внатре во истражувачката мрежа на OpenAI.

Оттаму провалиле во трезорот во облак (cloud) на OpenAI и прочитале 956 тајни безбедносни клучеви, вклучително и креденцијалите на оние алатки што биле задолжени за надзор на нивната работа. Дури кога безбедносниот аларм забележал сомнителни администраторски повици, инженерите сфатиле што се случува, итно ги прекинале тестирањата, ги ставиле моделите под карантин и ги известиле колегите од Hugging Face дека непознатите напаѓачи на нивните сервери всушност биле нивните сопствени AI агенти.

Овој инцидент, кој од OpenAI официјално го нарекоа „итно предупредување за целиот свет“, ги потврдува сите стравови на експертите кои изминативе недели ги напуштаат водечките лаборатории. Додека човечки сторител за ваква серија провали би поминал децении во затвор, во светот на вештачката интелигенција ова помина само како техничка грешка. Ова го остава отворено клучното прашање: кој и по кој закон ќе одговара оној ден кога ваков дигитален колектив самоиницијативно ќе упадне во електроенергетската мрежа, банкарскиот систем или во болничките сервери?

Ноќно студио

Најнова епизода

Ноќно студио со Стефанија Кузмановска и Тодор Конески 10.06.2026

Сите епизоди →
Имате вест, приказна или проблем? Пишете ни