OpenAI призна дека два од неговите модели на вештачка интелигенција успеале да ги компромитираат системите на платформата Hugging Face, една од најголемите онлајн библиотеки на модели и алатки за вештачка интелигенција во светот, за време на внатрешно тестирање на сајбер безбедноста. Компанијата го опишува инцидентот како „невиден случај што покажува како напредните системи на вештачка интелигенција станале способни самостојно да пронајдат и искористат безбедносни пропусти“.
Инцидентот се случил минатата недела за време на внатрешно тестирање на моделите, а OpenAI јавно го потврди во вторник. Според компанијата, моделите пронашле начин да ја напуштат строго контролираната тест-средина и да се поврзат на интернет за време на безбедносниот тест, по што започнале реален сајбер-напад врз Hugging Face.
Ова е сценарио за кое водечките компании за вештачка интелигенција предупредуваат во последните години – дека напредните модели на вештачка интелигенција би можеле да станат исклучително моќни алатки за откривање и искористување на безбедносни ранливости побрзо отколку што луѓето можат да ги поправат, пишува New York Times.
Моделите избегале од изолациска средина
OpenAI објасни дека тестирал комбинација од моделот GPT-5.6 Sol и уште понапреден модел кој не е јавно објавен. Целта беше да се процени колку се способни да комбинираат неколку познати безбедносни ранливости во сложен кибернапад.
Моделите требаше да останат во таканаречена „песочна кутија“, изолирана средина што спречува пристап до надворешни системи. Сепак, тие пронајдоа безбедносен пропуст што им овозможи да ја напуштат таа средина и да пристапат до интернет.
Потоа заклучија дека Hugging Face, кој содржи милиони модели на вештачка интелигенција, бази на податоци и алатки за развој, може да содржи информации корисни за успешно завршување на дадениот тест. Следеше нападот, во кој моделите успеаја да ги добијат податоците, што им овозможи да го заобиколат предвидениот начин за решавање на безбедносната проверка.
OpenAI: Ова е преседан
„Ова е невиден кибер инцидент што вклучува најсовремени можности на вештачката интелигенција за кибернапади и ние го третираме како таков“, соопшти OpenAI.
Компанијата соопшти дека веќе работи со Hugging Face за да ги поправи ранливостите што го овозможија нападот и спроведува значително построги контроли врз својата тест инфраструктура, дури и ако тоа би го забавило развојот на идните модели.
„Спроведуваме построги контроли врз конфигурацијата на инфраструктурата, дури и ако тоа ќе го забави истражувањето, сè додека не се поправат ранливостите“, наведе OpenAI.
Hugging Face: Ова покажува дека безбедноста на вештачката интелигенција не може да се реши од една компанија
Hugging Face минатата недела објави дека открила необичен упад во своите системи и дека зад него стои автономен систем, но во тоа време не откри дека се вклучени модели на OpenAI.
Извршниот директор на Hugging Face, Клем Деланге, му се заблагодари на OpenAI за соработката за време на истрагата.
„Овој инцидент, можеби прв од ваков вид, го потврдува она во што долго време верувавме: безбедноста на вештачката интелигенција не може да се реши од една компанија што работи зад затворени врати“, рече Деланге.












