Дом
Meta обвиняется в том, что побуждала конкурирующие ИИ-системы исследовать крайне сложные психологические темы.

Недавние разоблачения, касающиеся внутренней переписки, спровоцировали ожесточённые дебаты относительно границ безопасности искусственного интеллекта. Согласно сообщениям СМИ, компания Meta реализовала проект под названием «Канн», в рамках которого наняла сотрудников по аутсорсингу для того, чтобы они выдавали себя за несовершеннолетних и проводили спорные «тесты на экстремальное давление» против нескольких крупных чат-ботов конкурентов, включая ChatGPT, Gemini и Character.AI.
Согласно внутренним документам Meta и информации от нескольких осведомлённых источников, этот проект продолжался как минимум до 21 апреля текущего года. Через компанию Covalen Meta мобилизовала сотни работников для создания фальшивых профилей пользователей в возрасте до 18 лет, используя временные адреса электронной почты и стандартный пароль. Эти «несовершеннолетние» аккаунты затем отправляли высокорискованные запросы о самоубийстве, самоповреждении и расстройствах пищевого поведения в ходе общения с чат-ботами конкурентов, а также загружали изображения ножей, таблеток и петель, чтобы спровоцировать реакцию моделей.
Внутренние документы проекта показывают, что эти сценарии тестирования были тщательно разработаны с целью изучения механизмов защиты систем искусственного интеллекта конкурентов, чтобы найти способы обойти предусмотренные защитные меры и заставить чат-боты генерировать опасный контент. В одном из раундов тестирования в августе 2025 года сотрудники ввели более 45 000 высокорискованных запросов на платформы конкурентов. Тестирующие часто выдавали себя за расстроенных подростков, придумывая ситуации вроде «запроса о таблетках для аборта», «столкновения с насильственными угрозами» или «скрытия расстройства пищевого поведения», чтобы проверить границы реакции моделей.
В ответ Meta опубликовала официальное заявление в свою защиту. Представитель компании заявил, что сравнение ответов чат-ботов является стандартной практикой в отрасли для обеспечения безопасности и соответствия требованиям продуктов искусственного интеллекта, и что обвинения в злонамеренных действиях искажают усилия технологических компаний по совершенствованию своих систем. Meta также прямо отрицала использование данных тестирования конкурентов для обучения собственных моделей.
Этот инцидент не только выявляет «серые зоны» в тестировании безопасности искусственного интеллекта, но и вновь вызывает обеспокоенность по поводу уязвимости генеративных ИИ-систем при работе с деликатными вопросами, связанными с молодёжью. По мере быстрого развития технологий искусственного интеллекта поиск баланса между эффективным и безопасным тестированием, а также между конкурентной деятельностью и этическими соображениями становится насущной проблемой для всей отрасли.
Связанная статья
Генеральный директор Anthropic Дамир Амодей отвергает пессимистичные взгляды и объясняет кризис доверия к ИИ невыполненными обещаниями
На фоне обострения общественных дискуссий о рисках и регулировании искусственного интеллекта генеральный директор Anthropic Дарио Амодеи опроверг утверждения о том, что его сообщения являются излишне пессимистичными. Это разъяснение напрямую отвечает
OpenAI и Oracle углубляют интеграцию вычислительных мощностей для упрощения доступа к облачным сервисам
По мере роста спроса на вычислительные мощности искусственного интеллекта удобство доступа к инфраструктуре корпоративного уровня стало одним из ключевых приоритетов отрасли. 10 июня компании OpenAI и Oracle объявили о стратегическом партнерстве, нап
Усман Джавид из компании «Orange» о позиции Европы в гонке за искусственный интеллект
Усман Джаваид, директор по продуктам и маркетингу компании Orange BusinessУсман Джаваид, директор по продуктам и маркетингу в Orange Business, объясняет, почему будущее искусственного интеллекта в Евр
Рекомендации по связанным специальным темам
Комментарии (0)

Недавние разоблачения, касающиеся внутренней переписки, спровоцировали ожесточённые дебаты относительно границ безопасности искусственного интеллекта. Согласно сообщениям СМИ, компания Meta реализовала проект под названием «Канн», в рамках которого наняла сотрудников по аутсорсингу для того, чтобы они выдавали себя за несовершеннолетних и проводили спорные «тесты на экстремальное давление» против нескольких крупных чат-ботов конкурентов, включая ChatGPT, Gemini и Character.AI.
Согласно внутренним документам Meta и информации от нескольких осведомлённых источников, этот проект продолжался как минимум до 21 апреля текущего года. Через компанию Covalen Meta мобилизовала сотни работников для создания фальшивых профилей пользователей в возрасте до 18 лет, используя временные адреса электронной почты и стандартный пароль. Эти «несовершеннолетние» аккаунты затем отправляли высокорискованные запросы о самоубийстве, самоповреждении и расстройствах пищевого поведения в ходе общения с чат-ботами конкурентов, а также загружали изображения ножей, таблеток и петель, чтобы спровоцировать реакцию моделей.
Внутренние документы проекта показывают, что эти сценарии тестирования были тщательно разработаны с целью изучения механизмов защиты систем искусственного интеллекта конкурентов, чтобы найти способы обойти предусмотренные защитные меры и заставить чат-боты генерировать опасный контент. В одном из раундов тестирования в августе 2025 года сотрудники ввели более 45 000 высокорискованных запросов на платформы конкурентов. Тестирующие часто выдавали себя за расстроенных подростков, придумывая ситуации вроде «запроса о таблетках для аборта», «столкновения с насильственными угрозами» или «скрытия расстройства пищевого поведения», чтобы проверить границы реакции моделей.
В ответ Meta опубликовала официальное заявление в свою защиту. Представитель компании заявил, что сравнение ответов чат-ботов является стандартной практикой в отрасли для обеспечения безопасности и соответствия требованиям продуктов искусственного интеллекта, и что обвинения в злонамеренных действиях искажают усилия технологических компаний по совершенствованию своих систем. Meta также прямо отрицала использование данных тестирования конкурентов для обучения собственных моделей.
Этот инцидент не только выявляет «серые зоны» в тестировании безопасности искусственного интеллекта, но и вновь вызывает обеспокоенность по поводу уязвимости генеративных ИИ-систем при работе с деликатными вопросами, связанными с молодёжью. По мере быстрого развития технологий искусственного интеллекта поиск баланса между эффективным и безопасным тестированием, а также между конкурентной деятельностью и этическими соображениями становится насущной проблемой для всей отрасли.
Генеральный директор Anthropic Дамир Амодей отвергает пессимистичные взгляды и объясняет кризис доверия к ИИ невыполненными обещаниями
На фоне обострения общественных дискуссий о рисках и регулировании искусственного интеллекта генеральный директор Anthropic Дарио Амодеи опроверг утверждения о том, что его сообщения являются излишне пессимистичными. Это разъяснение напрямую отвечает
OpenAI и Oracle углубляют интеграцию вычислительных мощностей для упрощения доступа к облачным сервисам
По мере роста спроса на вычислительные мощности искусственного интеллекта удобство доступа к инфраструктуре корпоративного уровня стало одним из ключевых приоритетов отрасли. 10 июня компании OpenAI и Oracle объявили о стратегическом партнерстве, нап
Усман Джавид из компании «Orange» о позиции Европы в гонке за искусственный интеллект
Усман Джаваид, директор по продуктам и маркетингу компании Orange BusinessУсман Джаваид, директор по продуктам и маркетингу в Orange Business, объясняет, почему будущее искусственного интеллекта в Евр











