Ботови на OpenAI избегаа од тест за да ги украдат одговорите

Звучи како криминалистички извештај или сценарио за трилер. Двајца најталентирани студенти на тестирање избегале од заклучена лабораторија и упаднале во туѓа библиотека за да ги грабнат одговорите и да го положат тестот со највисока оценка. Студентите во овој случај се два врвни модели со вештачка интелигенција на OpenAI, кои самите ја смислиле оваа сложена операција.

Компанијата на Сем Алтман соопшти дека моделот за кодирање и кибернетска безбедност GPT-5.6 Sol и друг уште понапреден модел, кој досега не е објавен за користење, самостојно и без дозвола избегале од изолираната средина во која го полагале тестот ExploitGym за квантифицирање на кибернетски способности преку експлоатација на сложени патеки на напад.

Се протнале од изолацијата преку досега непозната „zero-day“ ранливост во инфраструктурата на OpenAI. Го хакирале безбедносниот систем и се најавувале од машина на машина се додека не стигнале до некоја што има пристап до интернет.

Од тука им било полесно. Веќе знаеле дека одговорите на тестот може да ги има во базите со податоци на компанијата Hugging Face каде што заради споредба се чуваат резултати на разни модели со ВИ. Ја пробиле заштитата, но биле откриени и фатени пред да ги украдат одговорите. Сепак, сето тоа што го направиле претходно може да се смета дека е доволно за да го положат тестот за „експлоатација на сложени патеки за напад“.

OpenAI и Hugging Face објавија дека по инцидентот ги затвориле дупките во своите системи и дека соработуваат во истрагата.

Се потврдија претпоставките дека кибер-нападот од минатата недела дошол од врвна лабораторија, со оглед на софистицираноста на агентите. Цврсто веруваме дека ова не било злонамерен напад од нивна страна. Неверојатно е што сето ова се случило автономно, изјави извршниот директор на Hugging Face, Клеман Деланг.

Досега немало случај тестиран модел самостојно да избега од строга изолација на напредна лабораторија за ВИ, каква што е OpenAI. Загриженост во јавноста и во Белата куќа неодамна предизвика врвниот модел Mythos на Антропик, кој при експеримент успеал да ги пробие заштитните мерки на сите средини во кои бил тестиран.

Набрзо по тој инцидент, претседателот Доналд Трамп во јуни нареди задолжително тестирање на сите нови модели со ВИ за да се провери дали претставуваат ризик за националната безбедност.

Овој инцидент, кој веројатно е прв од ваков вид, го потврдува она во што одамна веруваме: прашањето за безбедноста на вештачката интелигенција нема да го реши ниту една поединечна компанија што работи во тајност. Тоа ќе се реши јавно и соработка, преку широк пристап до ВИ за секој што работи на одбраната, каде и да се наоѓа, изјави Деланг.

22 јули 2026 - 11:37