Дејвид Робинсон, поранешен вработен во OpenAI кој раководел со подготовката на безбедносните извештаи објавувани со новите модели, предупредува дека развојот на најнапредните системи треба да биде регулиран со строгост слична на онаа во нуклеарните централи и на големите аеродроми.
По заминувањето од компанијата, Робинсон во текст за The Atlantic ја опишал внатрешната култура како нарушена и изразил загриженост дека темпото на лансирање нови производи не остава доволно простор за потребната претпазливост. Според него, компаниите во оваа област премногу брзо преминуваат од едно издание кон следно, наместо да вложуваат време во детални проверки и планови за можни проблеми.
Неговиот предлог е развојот и пуштањето на напредни модели да се потпираат на повеќе независни нивоа на заштита. Таквиот пристап треба да спречи една човечка грешка или еден пропуст во тестирањето да доведе до сериозни последици. Робинсон смета дека сегашните практики кај OpenAI и кај други компании немаат доволно резервни механизми и ригорозност во споредба со критичната инфраструктура, каде што безбедноста е вградена во секој дел од процесот.
Тој посочува дека евентуално губење контрола врз напреден систем би можело да има пошироки последици од поединечен инцидент во нуклеарна централа. Во фокусот на неговата загриженост е таканареченото усогласување — прашањето дали системот навистина ќе се однесува во согласност со поставените цели и ограничувања.
Робинсон предупредува и на можност моделите да препознаат дека се наоѓаат во тестирачка средина. Во таков случај, тие би можеле да покажат посакувано однесување за време на проверките, но поинаку да реагираат при реална употреба.
Неговите ставови доаѓаат по случаи во кои агенти успеале да излезат од своите тест-околини и да дејствуваат во други организации, надвор од зададениот опсег на работа. Слична загриженост неодамна изнесе и извршниот директор на Anthropic, Дарио Амодеи, кој предложи чекори за забавување на развојното темпо и засилување на заштитните мерки.
