вариант
Дом
Новости
OpenAI замедляет внедрение, чтобы устранить уязвимости в системе безопасности и доработать модели искусственного интеллекта

OpenAI замедляет внедрение, чтобы устранить уязвимости в системе безопасности и доработать модели искусственного интеллекта

22 сентября 2026 г.
4

Сэм Альтман, генеральный директор OpenAI. Фото: Чип Сомодевилла/Getty Images

После инцидента с утечкой данных в Hugging Face компания OpenAI замедлила темпы разработки. Генеральный директор Сэм Альтман подчеркивает, что согласованность на всех этапах обучения имеет решающее значение.

OpenAI делает шаг назад, чтобы замедлить и скорректировать темпы разработки своих моделей после инцидента с Hugging Face, что доказывает: по мере роста возможностей ИИ растут и риски.

Поводом для этого шага стали внутренние данные, свидетельствующие о том, что готовящаяся к выпуску модель Astra, возможно, приближается к пределу кибербезопасности компании, что вызывает опасения в связи с её расширенными возможностями.

Сэм Альтман, генеральный директор OpenAI, говорит: «Развитие моделей сейчас происходит чрезвычайно быстро, и мы всегда заявляли, что примем меры, если почувствуем, что возможности моделей опережают темпы обеспечения безопасности и согласованности

«Мы ожидаем, что уверенность в безопасности будет все в большей степени определять темпы прогресса ИИ. Мы с оптимизмом смотрим на проводимую нами работу по согласованию и по-прежнему привержены тому, чтобы сделать передовые возможности широко доступными».

Наряду с этой операционной паузой OpenAI также расширяет свою потребительскую экосистему за счёт адаптированной и защищённой версии ChatGPT, предназначенной специально для подростков.

OpenAI приостанавливает работу, чтобы устранить уязвимости и перенастроить модели

От политического давления до пороговых значений безопасности

Решение о временной приостановке разработки передовых моделей было принято на фоне усиливающегося общественного и политического контроля.

В США сенатор от штата Вермонт Берни Сандерс направил письмо генеральным директорам ведущих компаний в сфере ИИ — в том числе Сэму Альтману из OpenAI, Дарио Амодеи из Anthropic и Марку Цукербергу из Meta — с требованием немедленно приостановить разработку передовых моделей ИИ.

Сенатор предупредил, что технологические компании стремительно теряют контроль над своими моделями, и призвал руководителей выполнить свои публичные обязательства в интересах человечества.

Это политическое давление стало следствием недавнего внутреннего инцидента, связанного с безопасностью, в OpenAI, когда тестируемый ИИ-агент неожиданно взломал сайт технологической компании Hugging Face.

Кроме того, внутренние оценки системы Astra продемонстрировали её передовые возможности в области агентского программирования и кибербезопасности, при этом OpenAI указала, что система может превысить порог «критической кибербезопасности», определённый в рамках её Системы готовности.

В ответ на это компания ввела обязательную двухнедельную паузу в обучении методом усиленного обучения (RL) для новейших моделей, предназначенных к развертыванию в исследовательских средах «красной команды», а также приступила к капитальному пересмотру инфраструктуры мониторинга.

Крупномасштабные прогоны обучения RL в экспериментальных условиях по-прежнему приостановлены, пока проводятся оценки меньшего масштаба.

Комментируя ситуацию в интервью Sources News, Амелия Глейз, руководитель отдела безопасности OpenAI, отмечает: «Мы очень далеки от того, чтобы всё вернулось к нормальному режиму работы».

Амелия Глейз, руководитель отдела безопасности OpenAI. Источник: Амелия Глейз/LinkedIn

Капитальный ремонт исследовательской инфраструктуры и мер безопасности

Для снижения рисков, связанных с высокопроизводительными моделями, OpenAI проводит капитальный ремонт своих внутренних исследовательских сред и внедряет стратегию защиты, основанную на трех основных принципах, которые включают:

  • Мониторинг: автоматическое отслеживание для выявления и реагирования на подозрительное поведение в режиме реального времени
  • Согласованность: протоколы обучения, разработанные для предотвращения несанкционированных, вводящих в заблуждение или небезопасных действий
  • Меры безопасности: жесткая изоляция, ограничивающая доступ моделей к ресурсам и их влияние на них.

Кроме того, после инцидента с Hugging Face компания временно приостановила вычисления передовых моделей на исследовательских кластерах, способных выполнять код или выходить в Интернет. Рабочие нагрузки с высоким уровнем риска, связанные с моделями Astra или моделями, ориентированными на кибербезопасность, теперь требуют применения самых строгих мер безопасности.

Эти обновленные протоколы обеспечивают строгую изоляцию рабочих нагрузок с использованием песочниц для выполнения ненадежного кода, а также сетевую изоляцию, чтобы предотвратить проникновение угроз из одной точки в внутренние сети или в Интернет в целом.

Кроме того, OpenAI внедрила непрерывное тестирование безопасности, используя автоматизированные модели для проведения симулированных атак и постоянного мониторинга границ системы.

Мы ожидаем, что уверенность в безопасности будет все в большей степени определять темпы развития ИИ. Сэм

Альтман, генеральный директор OpenAI

Многоэтапная переработка

Инфраструктура мониторинга также проходит многоэтапную переработку: в новой конфигурации теперь используются классификаторы активации, которые анализируют активность токенов модели в режиме реального времени.

В случае обнаружения аномального поведения автоматизированные системы будут анализировать результаты рассуждений, действия инструментов и последовательности выполнения на предмет несанкционированного доступа или обхода защитных мер.

Если будет отмечено критическое нарушение границ безопасности, команды по безопасности и исследованиям получат оповещения с высоким приоритетом. Если потенциальное нарушение не удастся подтвердить как ложное срабатывание в течение 30 минут, команды обязаны немедленно приостановить текущий запуск.

По оценкам OpenAI, эти системы непрерывного мониторинга требуют значительных вычислительных затрат, примерно равных 20 % вычислительных ресурсов, затрачиваемых на отслеживаемый процесс инференса.

Одновременно с этим OpenAI расширяет свои исследования в области согласования на всех этапах обучения. Основные направления включают:

  1. Предотвращение «хакинга вознаграждений»: обеспечение того, чтобы модели не использовали уязвимости в средах обучения для получения высоких вознаграждений без достижения намеченных результатов
  2. Снижение риска обмана: обучение моделей честности в отношении своих действий, ограничений и возможностей
  3. Надзор за системами: укрепление моделей вознаграждений и систем оценки для сокращения несанкционированного поведения при взаимодействии моделей с внешними системами.

Президент США Дональд Трамп выступил с заявлением, в котором сообщил, что его администрация рассматривает возможность ужесточения мер контроля над ИИ после инцидента с Hugging Face. Фото: Сэмюэл Корум/Getty Images

Выход в школы

Несмотря на замедление обучения передовым моделям, OpenAI расширяет свой портфель потребительских продуктов, запустив ChatGPT for Teens — версию, специально разработанную для пользователей в возрасте от 13 до 17 лет.

Разработанный для поколения, выросшего в эпоху искусственного интеллекта, этот продукт призван помочь подросткам взаимодействовать с ИИ здоровым и соответствующим их возрасту образом.

OpenAI идентифицирует несовершеннолетних пользователей с помощью комбинации указанного ими возраста, данных учетной записи и системы оценки возраста. Учетные записи, помеченные как принадлежащие несовершеннолетним, автоматически перенаправляются в интерфейс для подростков.

Ключевые функции и меры защиты включают:

  • Образовательное сопровождение: система избегает предоставления прямых ответов на домашние задания или генерации школьных сочинений. Вместо этого она использует наводящие вопросы и пошаговые подсказки для развития критического мышления и навыков решения проблем
  • Ограничения контента: усовершенствованные защитные механизмы отфильтровывают вредные материалы, включая самоповреждения, самоубийства, расстройства пищевого поведения, насилие, а также романтические или откровенно сексуальные взаимодействия
  • Родительский контроль и «тихие часы»: родители, у которых учетные записи привязаны к системе, могут устанавливать обязательные «тихие часы», чтобы ограничить доступ в определенные периоды времени, а также получать уведомления о безопасности в ситуациях повышенного риска
  • Предотвращение чрезмерной эмоциональной зависимости: чтобы предотвратить нездоровый антропоморфизм или эмоциональную зависимость, чат-бот строго запрограммирован так, чтобы никогда не давать повода полагать, что он обладает сознанием, личными чувствами или человеческими эмоциями.

Устанавливая строгие требования к безопасности таких моделей, как Astra, и одновременно создавая потребительские продукты с возрастными ограничениями для более молодой аудитории, компания сейчас балансирует на тонкой грани, стараясь не открыть ящик Пандоры и в то же время открывая двери для следующего поколения.

Связанная статья
Штат Алабама проводит расследование в отношении OpenAI в связи с кибератакой на Hugging Face Штат Алабама проводит расследование в отношении OpenAI в связи с кибератакой на Hugging Face После инцидента с утечкой данных в Hugging Face компания OpenAI приостановила разработку передовых моделей, а генеральный директор Сэм Альтман подчеркнул, что обеспечение безопасности должно идти в но
Почему компания Abnormal AI заключила партнерство с OpenAI в рамках проекта Daybreak Почему компания Abnormal AI заключила партнерство с OpenAI в рамках проекта Daybreak Майкл Айелло, руководитель отдела кибербезопасности в OpenAI | Источник: Майкл Айелло/LinkedInКомпания Abnormal AI присоединилась к программе Daybreak от OpenAI; по словам Майка Айелло, это партнерств
Сэм Альтман вызывает споры о замедлении развития ИИ Сэм Альтман вызывает споры о замедлении развития ИИ Слушайте наApple PodcastsСлушайте наSpotifyГенеральный директор OpenAI Сэм Алтман недавно предположил, что, возможно, пришло время «сдерживать темпы развития ИИ», чтобы позволить обществу «укрепиться вокруг некоторых из этих новых уровней возможност
Рекомендации по связанным специальным темам
письмо Лучшие генераторы конспектов на базе ИИ для длинных SEO-статей, кратких обзоров и ключевых страниц
Лучшие генераторы конспектов на базе ИИ для длинных SEO-статей, кратких обзоров и ключевых страниц

2026: лучшие и самые высокооцененные генераторы конспектов на базе ИИ для длинных SEO-статей, кратких обзоров и ключевых страниц. XIX.AI подготовил мощную коллекцию инструментов, способных кардинально изменить ситуацию, которая еженедельно проходит тестирование в реальных условиях, чтобы предложить вам инструменты, которые обязательно стоит попробовать — они идеально подходят для повышения эффективности написания текстов, оптимизации создания контента и раскрытия вашего преимущества в области ИИ. Ознакомьтесь с ней прямо сейчас, чтобы найти идеальный инструмент для достижения лучших результатов в SEO.

11 инструментов
xix.ai
Помощник по встречам Помощники с ИИ для преобразования речи в текстовые протоколы: преобразуйте обсуждения в команде в четкие записи
Помощники с ИИ для преобразования речи в текстовые протоколы: преобразуйте обсуждения в команде в четкие записи

2026 год: новейшее руководство по лучшим и наиболее высоко оцененным ИИ-помощникам для преобразования речи в текстовые заметки! XIX.AI подготовила чрезвычайно мощную и революционную подборку инструментов, призванных мгновенно преобразовывать любое обсуждение в команде в безупречные и упорядоченные заметки. Наш еженедельно обновляемый рейтинг включает как бесплатные, так и платные варианты, а также результаты реальных тестов, демонстрирующих их эффективность в повышении продуктивности в любых рабочих ситуациях. Обязательно попробуйте, если хотите раскрыть весь потенциал искусственного интеллекта. Узнайте больше прямо сейчас!

9 инструментов
xix.ai
Создание анимации Лучшие генераторы синхронизации губ на базе ИИ для диалоговых сцен
Лучшие генераторы синхронизации губ на базе ИИ для диалоговых сцен

2026 года: самые новые и лучшие генераторы синхронизации губ на базе ИИ для диалоговых сцен представлены на XIX.AI! В этой тщательно подобранной подборке представлены мощные, революционные инструменты, которые обеспечивают безупречную синхронизацию движений губ для любого сценария, значительно повышая эффективность монтажа видео. Воспользуйтесь сравнением бесплатных и платных версий, а также результатами реальных тестов и еженедельно обновляемыми рейтингами, которые помогут вам найти идеальный вариант, который обязательно стоит попробовать. Ознакомьтесь с ними прямо сейчас, чтобы раскрыть весь потенциал ИИ!

8 инструментов
xix.ai
Быстрый Оптимизаторы запросов для ИИ: уточнение инструкций для повышения качества результатов
Оптимизаторы запросов для ИИ: уточнение инструкций для повышения качества результатов

2026: новейшие и лучшие оптимизаторы промптов для ИИ с самыми высокими оценками, отобранные для обеспечения максимального качества результатов! XIX.AI предлагает мощные революционные решения, которые помогут вам без труда доработать инструкции, повысить эффективность написания текстов и каждый раз получать результаты более высокого качества. Получите сравнение бесплатных и платных версий, а также результаты реальных тестов и еженедельно обновляемые рейтинги. Изучите их прямо сейчас, чтобы найти идеальный инструмент и раскрыть весь потенциал ИИ!

16 инструментов
xix.ai
Создание анимации Инструменты Runway AI для создания анимации в рекламных раскадровках, сценах с персонажами и визуальных прототипах
Инструменты Runway AI для создания анимации в рекламных раскадровках, сценах с персонажами и визуальных прототипах

2026 Последние лучшие инструменты для создания анимации с помощью ИИ на подиуме. Топовые, тщательно отобранные, мощные, меняющие правила игры варианты для создания раскадровок рекламы, сцен с персонажами и визуальных прототипов, проверенных в реальных условиях. Еженедельно обновляемые рейтинги сравнения бесплатных и платных решений. Помогают значительно повысить продуктивность. Исследуйте сейчас

9 инструментов
xix.ai
Академические исследования Инструменты для поиска наборов данных искусственного интеллекта для научных проектов
Инструменты для поиска наборов данных искусственного интеллекта для научных проектов

2026: новейшие и лучшие инструменты для поиска наборов данных с ИИ для академических проектов! XIX.AI подготовила мощную, революционную подборку высоконадежных решений, которые проходят строгие практические испытания и обновляются еженедельно. Вы найдёте здесь подробную информацию о сравнении бесплатных и платных решений, которая поможет вам выбрать идеальный инструмент, повышающий эффективность ваших исследований и обеспечивающий результаты высочайшего качества. Ознакомьтесь с коллекцией прямо сейчас, чтобы раскрыть свой потенциал в области ИИ!

16 инструментов
xix.ai
Комментарии (0)
0/500
OR