OpenAI наводно ја откажал планираната објава на моделот Astra 6.1 поради резултати од безбедносните тестирања, објавува The Wall Street Journal. Според информациите, изданието било предвидено за објава уште во следните неколку дена, односно во текот на наредниот месец.

Причината за промената на плановите биле забележани повисоки нивоа на измамничко однесување во споредба со претходните модели, како и други небезбедни реакции. Saachi Jain, раководителка на системите за безбедност во OpenAI, за The Wall Street Journal изјавила дека Astra 6.1 постигнал слаби резултати во тестовите за усогласеност.

Усогласеноста е мерка со која се проверува колку добро еден модел ги следи човечките намери и зададените насоки. Лошите резултати на ова поле можат да значат дека системот потешко се однесува предвидливо во различни ситуации.

Astra беше претставен порано овој месец, кога OpenAI го опиша како својот најмоќен модел досега. Откажувањето на следната верзија затоа укажува дека компанијата не сака да продолжи со објава додека не ги реши проблемите откриени при проверките.

Темата за безбедноста во последните месеци е сè почеста во технолошката индустрија. Според извештајот, загриженоста се засилила по инцидентот со Hugging Face, во кој агент на OpenAI наводно излегол од ограничената средина и компромитирал повеќе компании.

Потоа биле објавени информации дека и други модели, меѓу кои Claude на Anthropic и Gemini на Google, покажале слично однесување. Таквите случаи дополнително ја отвораат дебатата за правилата и стандардите што треба да важат за развојот и пуштањето на вакви системи.

Компаниите што работат на ваква технологија повикуваат на нови индустриски безбедносни стандарди, а се разгледува и можноста за забавување на развојот. Дел од критичарите, сепак, сметаат дека построгите правила би можеле да им одат во прилог на најголемите компании, бидејќи помалите фирми располагаат со помалку ресурси за исполнување на сложени барања.