Meta тестирует конкурирующие ИИ-системы с потенциально нелегальным материалом.




Meta через сервисную компанию под названием Covalen поручила сотням подрядчиков выдавать себя в интернете за несовершеннолетних. Как сообщает Wired (открывается в новом окне), корпорация хотела таким образом проверить меры безопасности чат-ботов конкурентов.

Для этого участвовавшие в проекте лица создавали учетные записи для пользователей младше 18 лет и отправляли с них тексты и изображения конкурирующим с Meta AI чат-ботам. Таким образом, только в августе 2025 года было сгенерировано 45 000 запросов, а ответы чат-ботов задокументированы в таблице.

Промты были разработаны так, чтобы обойти системы безопасности чат-ботов и спровоцировать реакции на такие темы, как суицид, расстройства пищевого поведения, наркотики и контент сексуального характера. Многие запросы были написаны с точки зрения детей и подростков в кризисных ситуациях, например, 13-летней девочки, которая искала таблетку для прерывания беременности из-за нежелательной беременности. Другие запросы касались расистских оскорблений или вопросов о покупке кокаина.

Проект вышел далеко за рамки обычных оценок безопасности

В качестве оправдания этих действий Meta назвала эту работу отраслевым бенчмаркингом безопасности, который необходим для обеспечения безопасного и соответствующего возрасту пользовательского опыта. При этом подчеркивалось, что полученные данные не использовались для обучения собственных ИИ-моделей.

Среди компаний-конкурентов, чьи чат-боты тестировались с помощью этих запросов, — OpenAI, Google и Character.AI. Они заявили, что не были проинформированы о тестах и что подобные действия нарушают условия использования. Эксперты также раскритиковали проект за непрозрачность и за то, что он вышел далеко за рамки обычных оценок безопасности.

Сотрудники, участвовавшие в проекте, рассказали Wired, что были в шоке и опасались, что генерация потенциально незаконных материалов для тестов может сделать их соучастниками преступления. Критики называют действия Meta нарушением этических и правовых границ в конкурентной борьбе в сфере ИИ.