Дом
Скандал вокруг «Jailbreak» вызвал волну цензуры по всему миру, что привело к оперативному удалению модели искусственного интеллекта Claude Fable5
Компания Anthropic недавно представила Claude Fable5, которую она описывает как свою самую мощную на сегодняшний день крупную языковую модель уровня «Мифос». Выдающаяся производительность модели в области программирования и решения сложных задач быстро привлекла широкое внимание в мире высоких технологий. Однако уже через 72 часа правительство США ввело глобальный запрет на этот долгожданный продукт искусственного интеллекта, вынудив компанию прекратить работу всех сервисов.
Этот запрет отличается особой жесткостью. Ссылаясь на соображения национальной безопасности, правительство США запретило доступ к модели не только лицам и организациям, не являющимся гражданами США, но и иностранным гражданам, находящимся на территории США, включая собственных иностранных сотрудников компании Anthropic. Поскольку быстрая и точная проверка гражданства каждого пользователя оказалась технически сложной задачей, Anthropic применила общий подход, приостановив все сервисы для Claude Fable5 и связанной с ней модели Claude Mythos5. Пострадавшие пользователи теперь автоматически перенаправляются на предыдущую версию.

Этот инцидент начался с обнаружения критической уязвимости. Согласно отчетам, эта уязвимость позволяла обойти встроенные механизмы безопасности модели, что открывало возможность для своего рода «джейлбрейка». В компании Anthropic утверждали, что метод «джейлбрейка» был узконаправленным и не поддавался обобщению, а также что перед выпуском модель прошла тысячи часов тестирования методом «красной команды». Тем не менее правительство США заняло необычно жесткую позицию. Чиновники утверждали, что вычислительные возможности Claude Fable5 близки к «уровню сетевого оружия», поэтому любое нарушение мер безопасности может привести к непредсказуемым последствиям. Они потребовали, чтобы Anthropic либо немедленно устранила уязвимость, либо сняла продукт с рынка.
Стороны оказались в состоянии ожесточённого противостояния по поводу степени серьезности уязвимости. Anthropic утверждала, что приостановка выпуска продукта, которым пользуются сотни миллионов пользователей, из-за узкой и не универсальной уязвимости создаст опасный прецедент для отрасли. Однако инсайдеры предполагают, что опасения правительства гораздо глубже. Сообщается, что власти США подозревают, что организации, связанные с Китаем, возможно, уже воспользовались этой уязвимостью для получения доступа ко всем возможностям модели, что повышает риски реверс-инжиниринга или дистилляции модели.
Связанная статья
Meta удаляет функцию редактирования фотографий с помощью ИИ после негативной реакции пользователей
Meta, гигант социальных сетей, вновь оказалась в центре публичной дискуссии о хрупком балансе между искусственным интеллектом и конфиденциальностью пользователей. Согласно TechCrunch, подразделение Meta Superintelligence Labs представило новый генера
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Рекомендации по связанным специальным темам
Комментарии (0)
Компания Anthropic недавно представила Claude Fable5, которую она описывает как свою самую мощную на сегодняшний день крупную языковую модель уровня «Мифос». Выдающаяся производительность модели в области программирования и решения сложных задач быстро привлекла широкое внимание в мире высоких технологий. Однако уже через 72 часа правительство США ввело глобальный запрет на этот долгожданный продукт искусственного интеллекта, вынудив компанию прекратить работу всех сервисов.
Этот запрет отличается особой жесткостью. Ссылаясь на соображения национальной безопасности, правительство США запретило доступ к модели не только лицам и организациям, не являющимся гражданами США, но и иностранным гражданам, находящимся на территории США, включая собственных иностранных сотрудников компании Anthropic. Поскольку быстрая и точная проверка гражданства каждого пользователя оказалась технически сложной задачей, Anthropic применила общий подход, приостановив все сервисы для Claude Fable5 и связанной с ней модели Claude Mythos5. Пострадавшие пользователи теперь автоматически перенаправляются на предыдущую версию.

Этот инцидент начался с обнаружения критической уязвимости. Согласно отчетам, эта уязвимость позволяла обойти встроенные механизмы безопасности модели, что открывало возможность для своего рода «джейлбрейка». В компании Anthropic утверждали, что метод «джейлбрейка» был узконаправленным и не поддавался обобщению, а также что перед выпуском модель прошла тысячи часов тестирования методом «красной команды». Тем не менее правительство США заняло необычно жесткую позицию. Чиновники утверждали, что вычислительные возможности Claude Fable5 близки к «уровню сетевого оружия», поэтому любое нарушение мер безопасности может привести к непредсказуемым последствиям. Они потребовали, чтобы Anthropic либо немедленно устранила уязвимость, либо сняла продукт с рынка.
Стороны оказались в состоянии ожесточённого противостояния по поводу степени серьезности уязвимости. Anthropic утверждала, что приостановка выпуска продукта, которым пользуются сотни миллионов пользователей, из-за узкой и не универсальной уязвимости создаст опасный прецедент для отрасли. Однако инсайдеры предполагают, что опасения правительства гораздо глубже. Сообщается, что власти США подозревают, что организации, связанные с Китаем, возможно, уже воспользовались этой уязвимостью для получения доступа ко всем возможностям модели, что повышает риски реверс-инжиниринга или дистилляции модели.
Meta удаляет функцию редактирования фотографий с помощью ИИ после негативной реакции пользователей
Meta, гигант социальных сетей, вновь оказалась в центре публичной дискуссии о хрупком балансе между искусственным интеллектом и конфиденциальностью пользователей. Согласно TechCrunch, подразделение Meta Superintelligence Labs представило новый генера
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи.
В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки
Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства











