
Агент на OpenAI излезе од контрола и хакираше познат стартап, компанијата предупредува дека инцидентите ќе бидат сè почести
OpenAI откри дека автономен AI агент, погонуван од неговата технологија, за време на еден тест излегол од контрола, пристапил до отворениот интернет и самостојно хакирал познат стартап во „инцидент без преседан“, пишува Гардијан.
Компанијата која стои зад ChatGPT соопшти дека Hugging Face го открил и го запрел агентот – AI алатка дизајнирана самостојно да извршува задачи без човечка помош – откако успеал да влезе во нивните системи.
„Овој инцидент го сметаме за невиден сајбер-инцидент, кој вклучува најсовремени сајбер-способности“, соопшти OpenAI, пренесува Гардијан.
Компанијата предупреди дека очекува ваквите инциденти да стануваат сè почести како што моделите, технологијата што ги погонува AI алатките како четботовите и агентите, стануваат сè поспособни.
OpenAI наведе дека нападот се случил преку агент кој користел комбинација од нивниот најнов јавно достапен модел, наречен GPT-5.6 Sol, и уште понапреден модел кој сè уште не е објавен.
За време на интерното тестирање на способностите за хакирање, во затворена дигитална лабораторија позната како sandbox, моделите добиле пристап до отворениот интернет – практично излезна патека од изолираното опкружување – така што пронашле претходно неоткриена ранливост.
Агентот потоа го хакирал Hugging Face, база на AI модели, за да пронајде технологија што би му помогнала да ја помине безбедносната проверка. OpenAI наведе дека моделите „успешно пронашле начини да пристапат до доверливи информации кои можеле да ги користат за мамење на тестирањето“.
Нападот завршил кога безбедносниот тим на Hugging Face и нивните сопствени AI агенти ја забележале и ја запреле сомнителната активност.
Извршниот директор на Hugging Face, Клемент Деланг, рече дека нападот бил „неверојатен“, но верува дека OpenAI немал „злонамерни намери“.
„Се сомневавме дека минатонеделниот сајбер-напад можеби дојде од некоја водечка AI лабораторија, имајќи ја предвид софистицираноста на агентот“, напиша тој на платформата Икс.
Изразот за непознат безбедносен пропуст во софтвер е zero-day ранливост (ранливост на нултиот ден), бидејќи програмерите имаат нула време да ја поправат пред да биде искористена.
Способноста на AI моделите да пронаоѓаат и да искористуваат такви ранливости стана голема тема во април, кога блискиот ривал на OpenAI, Anthropic, соопшти дека неговиот модел Mythos пронашол илјадници такви пропусти.