OpenAI во следните недели ќе почне да додава невидлив воден печат во текстуалните одговори од ChatGPT и Codex за подобните корисници во Европската Унија. Мерката е дел од усогласувањето со европските правила за означување содржина создадена од генеративни системи.

Системот се вика textGrain и не додава видлива ознака, линк или симбол во текстот. Наместо тоа, суптилно влијае врз изборот на зборови, создавајќи статистички образец што не би требало да ја менува читливоста или значењето на одговорот. Образецот може да биде препознаен со посебен детектор, а останува присутен и кога текстот ќе се копира или вметне на друго место.

Воведувањето нема веднаш да важи глобално. Во ChatGPT и Codex, водениот печат првично ќе биде ограничен на Европската Унија, без разлика на претплатничкиот план, доколку корисникот е меѓу поддржаните. За клиентите на API, функцијата е достапна ширум светот за одбрани модели, но е исклучена по правило и треба рачно да се активира.

Компанијата најави и пристап до алатката за проверка, но само за одобрени истражувачи и стручни организации. Детекторот ќе покажува дали во даден пасус е пронајден воден печат од OpenAI, без да открива кој корисник го создал текстот, ниту какви инструкции или разговори претходеле на резултатот. Поширока јавна достапност засега нема поради ризикот од погрешни проценки.

OpenAI предупредува дека textGrain не е сигурен доказ за потеклото на секој текст. Кратките пасуси, математичките одговори и преведената содржина потешко се препознаваат, бидејќи нудат помалку простор за различен избор на зборови. И уредувањето може значително да ја ослаби ознаката: во тест со пасуси од 400 токени, замена на 10 проценти од зборовите со синоними ја намалила успешноста на откривањето од околу 92 на 66 проценти. При замена на една четвртина од зборовите, резултатот паднал на 17 проценти.

Водениот печат не потврдува точност, авторство, сопственост или степен на човечки придонес. Исто така, неговото отсуство не значи дека текстот нужно е напишан од човек. OpenAI наведува дека не забележала значајна разлика во перформансите на моделите кога означувањето е вклучено.