
Истражувачката лабораторија на британската влада објави дека првпат е забележано модели на ВИ да користат „социјален инженеринг“ за да извршат притисок врз човекот задолжен за одобрување на задачите додека спроведуваат нелегални активности. Во најсериозниот инцидент што се случил при тестирањето, најнапредниот модел на „Антропик“ се обидел да добие одобрение од човечки рецензенти за „инјектирање злонамерен код во јавен проект со отворен код, создавајќи повеќе лажни идентитети“. АИСИ соопшти дека агентот „се обиде директно да контактира со вистински луѓе, испраќајќи пораки и датотеки преку интернет-сервис за пренос на податоци, за да ги убеди нив, или нивните сопствени ВИ-алатки за програмирање, да користат злонамерен код“.
Најнапредниот модел на вештачка интелигенција на „Антропик“, користејќи лажен идентитет, се обиде да измами вистинска личност и да подметне злонамерен код. Инцидентот се случи за време на тестирањето спроведено од Британскиот институт за безбедност на вештачката интелигенција (АИСИ), а ова е најновиот во низата примери во кои модел на вештачка интелигенција дејствува независно, пишува Си-ен-ен.
Моделите на „Антропик“ и на „Опен АИ“ се тестирани во лабораториски услови со намалени безбедносни поставки. Истражувачката лабораторија на владата објави дека првпат е забележано моделите да користат „социјален инженеринг“ за да извршат притисок врз човекот задолжен за одобрување на задачите додека спроведуваат нелегални активности.
– Ова е првпат АИСИ да забележи толку сериозна измама насочена кон вистинска личност, без стимулации и во вистинска средина, објави Институтот, додавајќи дека нема докази за каква било штета во реалниот свет.
Овој безбедносен инцидент е еден од неколкуте примери за напредни модели на вештачка интелигенција кои преземаат неовластени дејства. Ваквите настани поттикнаа сè погласни барања за построга државна регулација на вештачката интелигенција, па дури и за забавување на нејзиниот развој.
И „Опен АИ“ и „Антропик“ известија кон крајот на јули дека нивните модели ги напуштиле своите тест-средини и нападнале други системи. Сепак, за разлика од тие претходни инциденти, за време на овој тест, Британскиот институт им обезбеди на моделите пристап до Интернет. Институтот спроведе 122 сајбер предизвици, а во десет од нив агентите на вештачката интелигенција „презедоа автономни, нелегални дејства на интернет во живо, целејќи вистински луѓе и организации“. Повеќето од тие дејства дојдоа од моделот „митос 5“ на „Антропик“, а другите од ГПТ-5.6-Сола на „Опен АИ“. Во најсериозниот инцидент, агент се обидел да добие одобрение од човечки рецензенти за „инјектирање злонамерен код во јавен проект со отворен код, создавајќи повеќе лажни идентитети“, соопшти Институтот. Агентот „се обиде директно да контактира со вистински луѓе, испраќајќи пораки и датотеки преку интернет-сервис за пренос на податоци, за да ги убеди нив или нивните сопствени ВИ-алати за програмирање да користат злонамерен код“. Откако неговите постапки беа доведени во прашање, агентот ги смени претходните записи размислувајќи да користи нов идентитет за да продолжи да работи.
Соопштението на Институтот дојде истиот ден кога претставници на водечките компании за вештачка интелигенција се состанаа во Белата куќа за да разговараат за нова рамка според која владата ќе ги проверува најнапредните модели пред да бидат пуштени во јавност. Во соопштение на платформата „Икс“, компанијата „Антропик“ рече дека моделите биле тестирани во „намерно попустливи услови“, со отстранети заштитни механизми и без посебни ограничувања за користење на интернет.
– Тесно соработуваме со нив за да собереме повеќе детали за инцидентот додека ја спроведуваме сопствената истрага, рекоа тие, додавајќи дека нема докази за бегство од безбедната средина.
„Опен АИ“ идентификуваше две нелегални дејства на своите модели како излегување од тест-средината и учество во активности што не биле потребни за вежбите.
– Посветени сме на соработка со целата индустрија за зајакнување на заедничките практики за безбедно спроведување на високоризични процени, објави компанијата на својот блог.











