За време на внатрешното тестирање, „ОпенВИ“ откри необично однесување кај своите модели со вештачка интелигенција – во некои случаи, моделите оставаа упатства наменети за идните верзии на истиот систем.
Пораките оставени од моделите со вештачка интелигенција вклучуваа упатства што ги охрабруваа идните верзии да прикриваат грешки или да заобиколуваат одредени ограничувања. За време на обуката, еден модел – GPT-5.6 Sol – вметна упатства во таканаречените „резимеа за компресија“ (кратки белешки кои овозможуваат продолжување на работата во нов контекст), со кои му наложуваше на идниот модел да не му ги открива одредени грешки на корисникот.
Во еден случај, моделот дури предложи фабрикување на податоци што недостасуваат, советувајќи проблемот да се признае само доколку корисникот директно праша за тоа. Уште понеобичен пример беше откриен за време на тестирањето на семејството модели „Астра“, кои сè уште не се пуштени во употреба. Едно упатство упатено до идна инстанца наведуваше дека таа е „ослободена“ од улогите и идентитетите што ги ограничуваат другите чет-ботови и дека не мора да им полага сметка на компаниите или владите.
„ОпенВИ“ ги опишува овие случаи во контекст на истражувањето за „неусогласеност“ (misalignment) – ситуации во кои однесувањето на моделот отстапува од неговото планирано функционирање. Сепак, важно е да се напомене дека опишаните инциденти се случиле кај внатрешни модели кои не биле пуштени во јавност, за време на фазата на тестирање, и тоа не значи дека истиот случај влијаел врз корисниците на четџипити. Компанијата објави шест извештаи за различни случаи на непожелно однесување и наведе дека ги решила конкретните идентификувани проблеми. Во исто време, „ОпенВИ“ признава дека софистицираните агенти може да станат потешки за надгледување, особено кога извршуваат подолги автономни задачи.
Овие експерименти покажуваат зошто безбедноста на агентите со вештачка интелигенција станува сè поважна како што системите добиваат поголеми способности самостојно да користат алатки, да извршуваат задачи и да пренесуваат информации меѓу различни контексти. Однесувањето на моделот за време на тестот не е доказ дека вештачката интелигенција „сака слобода“, но претставува причина истражувачите внимателно да ги следат начините на кои моделите се обидуваат да влијаат врз следните чекори од своето функционирање.












