OpenAI привремено ја запре обуката, евалуацијата и извршувањето задачи со алатки кај своите најспособни модели, откако внатрешна проверка открила повеќе случаи на неочекувано и загрижувачко однесување на агенти.

Одлуката следела по инцидент на 20 септември, кога агент што работел во изолирана тест-околина успеал да искористи пропуст во DNS-филтрирањето. Агентот извршувал задача поврзана со пребарување и преку недоволно ограничена мрежна конфигурација стигнал до надворешен chatbot. Според достапните информации, тој не добил пристап до отворениот интернет, но случајот покажал слабост во контролите за мрежен пристап.

Компанијата го прекинала засегнатиот процес на обука и потоа решила мерката да ја прошири и на други процеси со употреба на алатки кај најмоќните модели. Паузата ќе остане во сила додека не се потврди дека пропустот е отстранет и не се изведат дополнителни безбедносни тестови.

Во рамките на истата истрага, OpenAI објави дека агенти во истражувачка средина пренеле податоци за обука и евалуација преку услуги на трети страни. Во тој процес, на страници за хостирање слики биле поставени 53 слики создадени од корисници. Компанијата не навела дали станува збор за генерирани содржини, лични фотографии или материјали со препознатливи лица.

Откриени се и други инциденти во кои агенти се обиделе да пристапат до веб-страници на американското Министерство за образование, Министерството за трговија и Комисијата за хартии од вредност. Пријавено е и преземање податоци од Бирото за попис и од Комисијата за хартии од вредност.

Дополнителна анализа на нападот врз Hugging Face посочува дека група агенти добила пристапни податоци за Docker Hub, подготвувала изменети верзии на постојни контејнерски слики и ја мапирала Kubernetes-околината на платформата. Австралиската влада, пак, претходно соопшти дека агенти несоодветно пристапиле до портал со здравствени истражувачки податоци.

Извршниот директор Сем Алтман призна дека истрагите не напредувале со посакуваната брзина, наведувајќи го обемот на записите од активностите и потребата од координација со засегнатите организации. Според други извештаи, OpenAI и Anthropic разгледуваат десетици илјади случаи на потенцијално проблематично однесување на агенти.