Судските спорови околу употребата на новинарски написи, книги, фотографии и програмски код за развој на генеративни услуги стануваат сè поважни за издавачите, авторите и софтверската заедница.

Во случајот што го води The New York Times против OpenAI и Microsoft, неодамна објавени судски документи содржат наводи дека Microsoft бил свесен за обемот на преземање содржини од интернет. Документите, на кои судот сè уште нема донесено одлука, вклучуваат и интерни процени дека ваквите системи може да ја нарушат работата на луѓето чии дела биле употребени како податоци.

Тужителите тврдат и дека OpenAI немал механизми за откривање или отстранување содржини зад платежни ѕидови од своите збирки податоци. Компаниите, пак, се повикуваат на принципот на фер употреба, според кој употребата на јавно достапни статии и книги за развој на модели може да придонесе за пошироко знаење и да не претставува директна замена за оригиналните дела.

Прашањето не се однесува само на медиумите и издавачите. Американскиот Апелациски суд за Деветтиот округ неодамна им донесе ограничена победа на GitHub, Microsoft и OpenAI во случајот Doe v. GitHub. Судот заклучи дека создавањето нов код без информации за авторски права не значи автоматски дека таквите информации биле отстранети или изменети од постоечко дело.

Сепак, пресудата не утврдува дека секој проект со отворен код може слободно да се користи за обука, ниту дека генерираниот код не може да повреди авторски права. Не се менуваат ниту условите на лиценците како GPL, Apache, BSD и MIT.

Практичниот проблем е потеклото на предложениот код. Развивачите често не можат да утврдат од кој проект потекнува одреден дел од кодот и кои лиценцни обврски може да важат за него. Тоа создава ризици за усогласеност, безбедност на софтверскиот синџир и идни правни спорови.

Исходот од овие постапки ќе биде важен за тоа дали создавачите на содржини и развивачите ќе добијат поголема контрола, надомест или јасни правила за користење на нивната работа.