искусственный интеллект

Учёные объяснили, в какой момент ИИ-контент становится оригинальным

По данным специалистов из Массачусетского технологического института (США), для этого необходимо «скормить» модели ИИ внушительный массив данных.

искусственный интеллект и авторские права, нарушение авторских прав, ИИ, нейросети
Изображение сгенерировано при помощи ИИ

Человечество ещё не решило, в каких случаях ИИ-контент нарушает авторские права художников, писателей и музыкантов, а в каких — нет. Исследователи из MIT тоже заинтересовал этот вопрос.

Команда решила проверить, как оригинальность сгенерированных картинок связана с объёмом информации, на которой обучился ИИ. Для этого специалисты обучили 24 ИИ-модели на разных наборах данных: некоторые «изучили» всего 256 изображений, другие — более 160 тыс. единиц контента из общедоступных коллекций.

«Если вы убираете часть данных, а результат работы модели не меняется, значит, эта часть данных не повлияла на результат», — поясняет Чжэн Дай, соавтор исследования.

Результаты показали: по мере роста набора данных связь между тем, что изучает модель, и тем, что она производит, ослабевает. Учёные назвали это явление «угасанием атрибуции». Иначе говоря, самый «эрудированный» ИИ обладает неким творческим потенциалом.

По мнению авторов статьи, их открытие делает актуальную дискуссию об авторских правах ещё более сложной.

«Если результаты не имеют ничего общего с каким-либо отдельным фрагментом обучающих данных, то возникают вопросы о добросовестном использовании и о том, являются ли эти генерации объектами авторского права как новые произведения», — рассуждает профессор Дэвид Гиффорд, соавтор исследования.

Ранее другое исследование показало, что люди не отличают короткие истории, написанные ИИ, от рассказов писателей.