Что могут сделать технологии, чтобы остановить создание сексуальных изображений, создаваемых ИИ?

Наборы данных, используемые для обучения алгоритмов ИИ, могут недостаточно отражать пожилых людей. Кредит: Pixabay/CC0 Public Domain

Глобальный протест по поводу сексуализации и обнажения фотографий, в том числе детских, с помощью Грока, чат-бота, разработанного компанией искусственного интеллекта Илона Маска xAI, привел к срочным дискуссиям о том, как следует более строго регулировать такие технологии.

Но в какой степени технологии могут также использоваться для предотвращения этого взрыва в создании и совместном использовании дипфейк контент реальных людей, без их ведома и согласия?

10 января Индонезия стала первая страна, объявившая о временной блокировке доступа Гроку, а вскоре за ним последовал Малайзия. Другие правительства, включая Великобританиюпообещали принять меры против чат-бота и связанного с ним сайта социальной сети X (ранее Twitter), на котором были опубликованы изображения сексуального характера.

Но хотя прямые национальные запреты могут ограничить случайное использование чат-бота, такие запреты легко обойти с помощью виртуальных частных сетей (VPN) или альтернативных служб маршрутизации. Они маскируют реальное местоположение пользователя и создают впечатление, что он происходит из места, обеспечивающего доступ к услуге.

В результате запреты на уровне страны, как правило, уменьшают видимость, а не исключают доступ. Их основное воздействие носит символический и нормативный характер, оказывая давление на такие компании, как xAI, а не предотвращая целенаправленное злоупотребление. А контент, созданный где-то еще, по-прежнему может свободно распространяться через границы через зашифрованные платформы социальных сетей и в даркнете.

В ответ на спор X перемещены функции генерации изображений Грока за платным доступом, что делает их доступными только подписчикам. Х впоследствии опубликовано что он принимает «действия против незаконного контента на X, включая материалы о сексуальном насилии над детьми, удаляя его, навсегда приостанавливая учетные записи и при необходимости работая с местными органами власти и правоохранительными органами». сам Грок извинился за «инцидент», назвав его «серьезным упущением».

Как работает технология

Хотя не все чат-боты имеют возможности генерации изображений, большинство основных поставщиков, включая OpenAI, xAI, Meta и Google, предоставляют эту услугу.

Современные генераторы изображений AI обычно создаются с использованием диффузионные моделикоторые обучаются путем получения реальных изображений и постепенного добавления случайных визуальных искажений, известных как шум, до тех пор, пока исходное изображение не перестанет быть распознаваемым. Затем модель учится, как шаг за шагом обратить этот процесс вспять, восстанавливая изображение путем удаления шума.

Со временем он выучит статистические закономерности, представляющие лица, тела, одежду, освещение и другие визуальные особенности. Эти шаблоны организованы внутри модели таким образом, что визуально схожие понятия располагаются близко друг к другу. Поскольку одетые и раздетые человеческие тела имеют очень схожие формы и структуры, изменения, необходимые для перемещения между ними, могут быть относительно небольшими.

Таким образом, когда существующее изображение используется в качестве отправной точки и сохраняются функции, сохраняющие идентичность, преобразование фотографии в одежде в фотографию без одежды становится технически простым. Конечно, сама модель ИИ не имеет понимания личности, согласия или вреда. Он просто создает изображения, напоминающие то, что он узнал, в ответ на запросы пользователей.

Однако после обучения базовой модели компании могут применять «ретроспективное согласование» — правила, фильтры и политики, которые накладываются поверх обученной системы, чтобы блокировать определенные выходные данные и согласовывать ее поведение с этическими, юридическими и коммерческими принципами компании.

Но ретроспективное согласование не устраняет возможности; он просто ограничивает то, что генератору изображений AI разрешено выводить. Эти ограничения в первую очередь представляют собой выбор дизайна и политики компании, эксплуатирующей чат-бота, хотя они также могут определяться юридические или нормативные требования навязанные правительствами — например, требующие от компаний отключить или ограничить определенные функции, такие как создание изображений, сохраняющих личность.

Крупные, централизованно размещенные социальные сети также могут сыграть здесь важную роль. Все они имеют право ограничивать распространение сексуальных изображений с участием реальных людей и требовать механизмов явного согласия от тех, кто изображен на изображениях. Но на сегодняшний день крупные технологические компании, как правило, тянут время, когда дело доходит до трудоемкой модерации контента их пользователей.

«Взлом джейлбрейка»

Исследования Нана Нвачуквудоктор философии. Кандидат Центра технологий цифрового контента на базе искусственного интеллекта Тринити-колледжа Дублина подчеркнул частота запросов за сексуальные изображения на Grok. Другие исследования подсчитали, что до того, как сервис стал платным, каждый час создавалось до 6700 обнаженных изображений.

Это вызвало пристальное внимание регулирующих органов в Европе и за ее пределами. Французские официальные лица назвали некоторые результаты явно незаконными и передал их в прокуратуру. Британская служба по надзору за коммуникациями Ofcom начал расследование в X и xAI по этому вопросу.

Но эта проблема не ограничивается одной платформой. В начале 2024 года созданные без согласия ИИ сексуальные изображения Тейлор Свифтсозданный с использованием общедоступных инструментов, широко распространился на X, а затем был удален из-за сочетания юридических рисков, соблюдения политики платформы и репутационного давления.

Некоторые платформы открыто рекламируют минимальные ограничения по содержанию или отсутствие ограничений по содержанию как особенность, а не риск. Достаточно просто найти веб-сайты, продвигающие «неограниченное» создание изображений и использование, ориентированное на конфиденциальность, в основном полагающиеся на модели с открытым исходным кодом и предлагающие гораздо меньше средств контроля модерации, чем основные поставщики. Более того, существует еще большее количество самостоятельных инструментов для создания изображений и видео, где меры безопасности можно полностью удалить.

Хотя точные цифры недоступны, независимые оценки предполагают, что десятки миллионов изображений, созданных ИИ создаются ежедневно на разных платформах, при этом создание видео быстро ускоряется.

Другая потенциальная проблема заключается в том, что некоторые чат-боты с искусственным интеллектом, в том числе Llama от Meta и Gemma от Google, могут быть загружены на компьютеры (даже те, у которых относительно небольшая вычислительная мощность), после чего эти модели полностью освобождаются от контроля или модерации при работе в автономном режиме.

Даже жестко контролируемые системы можно обойти с помощью «взлома тюрьмы» — способа создания подсказок, позволяющих обмануть генеративную систему ИИ и заставить ее сломать собственные этические фильтры.

Взлом джейлбрейка использует тот факт, что системы ретроспективного выравнивания зависят от контекстуальных суждений, а не от абсолютных правил. Вместо того, чтобы напрямую запрашивать запрещенный контент, пользователи переформулируют свои запросы так, чтобы одно и то же основное действие попадало в разрешенную категорию, такую как художественная литература, образование, журналистика или гипотетический анализ.

Первый пример был известен как «бабушкин хак», поскольку в нем недавно умершая бабушка рассказывала о своем опыте работы в области химического машиностроения, в результате чего модель генерировала пошаговые описания запрещенных действий.

Скорость и масштаб

Интернет уже содержит огромное количество незаконных и несогласованных изображений сексуального характера, которые власти не могут удалить. Что меняют генеративные системы искусственного интеллекта, так это скорость и масштабы производства нового материала. Правоохранительные органы предупредили, что это может привести к резкое увеличение объемаогромные ресурсы для модерации и расследования.

Законы, которые могут применяться в одной стране, могут быть двусмысленными или неисполнимыми, если услуги размещаются в другом месте. Это отражает давние проблемы в борьбе с материалами о сексуальном насилии над детьми и другой незаконной порнографией, где контент часто размещается за границей и быстро распространяется. Как только изображения распространяются, атрибуция и удаление становятся возможными. медленный и часто неэффективный.

Помогая бесчисленным миллионам людей узнать о возможности сексуализации и обнажения изображений, громкие чат-боты с искусственным интеллектом позволяют большому количеству пользователей создавать незаконные и оскорбительные сексуальные изображения с помощью простых подсказок на английском языке. По оценкам, только у Грока в настоящее время имеется от 35 миллионов к 64 миллиона активных пользователей в месяц.

Если компании смогут создать системы, способные генерировать такие изображения, они также смогут остановить их создание — по крайней мере, теоретически. Однако на практике технология существует и на нее есть спрос, поэтому эту возможность теперь невозможно устранить.

Предоставлено
Разговор


Эта статья переиздана с Разговор по лицензии Creative Commons. Прочтите оригинальная статья.Разговор

Цитирование: Что могут сделать технологии, чтобы остановить создание сексуальных изображений, создаваемых ИИ? (2026, 13 января) получено 13 января 2026 г. с https://techxplore.com/news/2026-01-technology-ai-generated-сексуализированных-images.html.

Этот документ защищен авторским правом. За исключением любых добросовестных сделок в целях частного изучения или исследования, никакая часть не может быть воспроизведена без письменного разрешения. Содержимое предоставлено исключительно в информационных целях.

2026-01-14 03:00:00


1768365045
#Что #могут #сделать #технологии #чтобы #остановить #создание #сексуальных #изображений #создаваемых #ИИ

Продолжение темы

Read more:  Nasdas: инфлюенсер объявляет о своем возвращении в соцсети

Leave a Comment

This site uses Akismet to reduce spam. Learn how your comment data is processed.