вариант
Дом
Новости
Руководители исследовательских центров призывают технический сектор отслеживать процессы рассуждений ИИ

Руководители исследовательских центров призывают технический сектор отслеживать процессы рассуждений ИИ

17 ноября 2025 г.
78

Руководители исследовательских центров призывают технический сектор отслеживать процессы рассуждений ИИ

Исследователи ИИ из OpenAI, Google DeepMind, Anthropic и широкой коалиции компаний и некоммерческих организаций выступают за углубление исследований в области мониторинга так называемых мыслительных процессов моделей рассуждений ИИ, говорится в опубликованном во вторник документе с изложением позиции.

Определяющей характеристикой моделей рассуждений ИИ, таких как o3 от OpenAI и R1 от DeepSeek, является использование цепочек мышления, или ЦМ - внешнего процесса, в котором модели ИИ систематически решают задачи, подобно тому, как человек использует бумагу для решения сложных математических уравнений. Модели рассуждений являются основой для работы ИИ-агентов, и авторы статьи утверждают, что мониторинг CoTs может стать жизненно важным методом для удержания под контролем все более способных и широко распространенных ИИ-агентов.

"Мониторинг CoT предлагает ценное дополнение к протоколам безопасности для передовых ИИ, предоставляя уникальное окно в то, как агенты ИИ принимают свои решения", - заявляют исследователи в документе. "Однако нет никакой уверенности в том, что этот уровень видимости сохранится. Мы призываем исследовательское сообщество и разработчиков передовых ИИ максимально использовать преимущества наблюдаемости CoT и изучить способы ее сохранения".

В документе содержится призыв к ведущим разработчикам ИИ изучить, что делает CoT "контролируемыми" - в частности, какие факторы повышают или понижают прозрачность того, как модели ИИ действительно генерируют свои ответы. Авторы отмечают, что хотя мониторинг CoT является многообещающим подходом для понимания моделей рассуждений ИИ, он остается хрупким, и они предостерегают от любых изменений, которые могут снизить его прозрачность или надежность.

Кроме того, авторы призывают разработчиков ИИ постоянно отслеживать возможность мониторинга CoT и изучить, как этот метод может быть в конечном итоге реализован в качестве меры безопасности.

Под документом подписались главный научный сотрудник OpenAI Марк Чен, генеральный директор Safe Superintelligence Илья Суцкевер, нобелевский лауреат Джеффри Хинтон, соучредитель Google DeepMind Шейн Легг, советник по безопасности xAI Дэн Хендрикс и соучредитель Thinking Machines Джон Шульман. Среди ведущих авторов - представители британского Института безопасности искусственного интеллекта и Apollo Research, а также представители METR, Amazon, Meta и Калифорнийского университета в Беркли.

Этот документ представляет собой объединенные усилия многих лидеров индустрии ИИ, направленные на ускорение исследований в области безопасности ИИ. Он появился в период острой конкуренции между технологическими компаниями - конкуренции, которая побудила Meta переманить лучших исследователей из OpenAI, Google DeepMind и Anthropic с помощью многомиллионных предложений. Среди наиболее востребованных исследователей - те, кто специализируется на агентах ИИ и моделях рассуждений.

Мероприятие Techcrunch

LIVE NOW! TechCrunch All Stage

Создавайте умнее. Масштабируйте быстрее. Общайтесь глубже. Присоединяйтесь к новаторам из Precursor Ventures, NEA, Index Ventures, Underscore VC и других компаний, чтобы провести день, наполненный практическими стратегиями, увлекательными семинарами и полезным общением.

Сэкономьте 450 долларов на пропуске на TechCrunch All Stage

Стройте умнее. Масштабируйте быстрее. Общайтесь глубже. Присоединяйтесь к новаторам из Precursor Ventures, NEA, Index Ventures, Underscore VC и других организаций, чтобы провести день, насыщенный практическими стратегиями, увлекательными семинарами и полезным общением.

Бостон, Массачусетс|15 июля ЗАРЕГИСТРИРОВАТЬСЯ СЕЙЧАС

"Мы находимся в переломном моменте, когда у нас появилась новая возможность цепочки мыслей. Она кажется очень полезной, но может исчезнуть через несколько лет, если ей не будет уделено пристальное внимание", - сказал в интервью TechCrunch Боуэн Бейкер, исследователь OpenAI, участвовавший в работе над документом. "Выпуск такого документа, как этот, на мой взгляд, является способом привлечь больше исследований и внимания к этой теме, пока не стало слишком поздно".

OpenAI впервые выпустила предварительную версию своей начальной модели рассуждений ИИ, o1, в сентябре 2024 года. В последующие месяцы технологическая индустрия быстро представила конкурирующие модели со схожими возможностями, а некоторые из них от Google DeepMind, xAI и Anthropic продемонстрировали еще более высокие показатели.

Тем не менее, понимание того, как работают модели рассуждений ИИ, по-прежнему ограничено. Хотя за последний год лаборатории ИИ добились значительных успехов в повышении производительности ИИ, это не всегда привело к более четкому пониманию процессов принятия решений.

Компания Anthropic стала пионером в понимании того, как функционируют модели ИИ - эта область известна как интерпретируемость. Ранее в этом году генеральный директор компании Дарио Амодеи пообещал раскрыть "черный ящик" моделей ИИ к 2027 году и увеличить инвестиции в интерпретируемость. Он также призвал OpenAI и Google DeepMind продолжить исследования в этой области.

Первые исследования Anthropic показывают, что CoT могут быть не совсем надежными индикаторами того, как эти модели генерируют ответы. В то же время исследователи OpenAI заявили, что мониторинг CoT может со временем стать надежным методом отслеживания согласованности и безопасности моделей ИИ.

Позиционные документы, подобные этому, направлены на повышение осведомленности и привлечение большего внимания к новым областям исследований, таким как мониторинг CoT. Такие компании, как OpenAI, Google DeepMind и Anthropic, уже проводят исследования в этой области, но эта публикация может помочь стимулировать дополнительное финансирование и исследования.

Связанная статья
OpenAI запускает более безопасную версию ChatGPT для подростков спустя несколько лет после того, как они начали ею пользоваться OpenAI запускает более безопасную версию ChatGPT для подростков спустя несколько лет после того, как они начали ею пользоваться После серии судебных исков, связанных с отсутствием протоколов безопасности в чат-ботах на базе ИИ — что стало одной из причин самоубийств подростков и других кризисов, связанных с психическим здоровь
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Tiffany Luck из NEA: Компании по-прежнему борются с вопросами окупаемости инвестиций в ИИ Tiffany Luck из NEA: Компании по-прежнему борются с вопросами окупаемости инвестиций в ИИ Загрузка плеера…Ранее в этом году «токеномаксимизация» доминировала в Кремниевой долине, когда генеральные директора призывали сотрудников максимально использовать возможности искусственного интеллекта. Однако этот энтузиазм быстро столкнулся с реал
Рекомендации по связанным специальным темам
Создание видео Генераторы привлекательных заглавий для коротких видеороликов с использованием ИИ: для Reels, Shorts и кампаний по запуску продуктов
Генераторы привлекательных заглавий для коротких видеороликов с использованием ИИ: для Reels, Shorts и кампаний по запуску продуктов

2026: лучшие современные генераторы захватывающих заставок для короткометражных видео на базе ИИ для Reels, Shorts и кампаний по запуску продуктов! XIX.AI подбирает самые высокооцененные и мощные инструменты, способные кардинально изменить ситуацию, которые в ходе реальных тестов демонстрируют результаты, которые обязательно стоит попробовать. Эта страница, обновляемая еженедельно, предлагает сравнительные рейтинги бесплатных и платных инструментов, чтобы помочь вам найти идеальное решение для повышения креативности и продуктивности при создании контента. Ознакомьтесь с ними прямо сейчас, чтобы раскрыть свой потенциал с помощью ИИ!

11 инструментов
xix.ai
письмо Инструменты для создания плана статей с использованием ИИ при написании длинных текстов
Инструменты для создания плана статей с использованием ИИ при написании длинных текстов

2026: лучшие и самые популярные инструменты для создания планов статей с помощью ИИ для написания длинных текстов! В эту тщательно подобранную подборку вошли мощные, революционные инструменты, которые генерируют точные и структурированные планы, прошедшие проверку на практике, что позволяет значительно повысить эффективность написания текстов. XIX.AI входит в эту элитную подборку. Получите сравнение бесплатных и платных версий, чтобы выбрать идеальный инструмент. Изучите их прямо сейчас и раскройте свой потенциал с помощью ИИ!

9 инструментов
xix.ai
чат-бот Лучшие приложения для ролевых чатов с ИИ для практики языка, подготовки к собеседованиям и ежедневной разговорной практики
Лучшие приложения для ролевых чатов с ИИ для практики языка, подготовки к собеседованиям и ежедневной разговорной практики

2026 г. — новейшие, лучшие и наиболее рейтинговые приложения для ИИ-ролевых чатов, предназначенные для практики языка, подготовки к собеседованиям и ежедневной беглости речи! XIX.AI предлагает мощную коллекцию, меняющую правила игры: бесплатные и платные варианты, реальные тесты и обновляемые еженедельно рейтинги. Эти обязательные к использованию инструменты помогут вам улучшить навыки письма, преодолеть трудности с беглостью и повысить эффективность общения во всех повседневных ситуациях. Исследуйте сейчас, чтобы найти идеальный инструмент для развития вашего языка!

10 инструментов
xix.ai
Музыкальная композиция Инструменты разделения стемов с использованием ИИ для создания ремиксов, подготовки образцов звука и формирования финальных версий караоке.
Инструменты разделения стемов с использованием ИИ для создания ремиксов, подготовки образцов звука и формирования финальных версий караоке.

2026 год: лучшие и наиболее высоко оценённые инструменты для разделения аудиосигналов с использованием ИИ, отобранные специально для работы над ремиксами, подготовки образцов звука и создания караоке-версий. Эти мощные революционные инструменты проходят реальные тесты, обеспечивая точную изоляцию аудиосигналов и значительно повышая производительность. XIX.AI предоставляет еженедельно обновляемый бесплатный справочник сравнения платных и бесплатных решений, который поможет вам найти оптимальный вариант, соответствующий вашим потребностям. Ознакомьтесь с ним прямо сейчас, чтобы раскрыть потенциал ИИ в вашей работе.

8 инструментов
xix.ai
Анализ данных ИИ-копилоты для SQL, предназначенные для создания панелей управления доходами, анализа воронки продаж и отслеживания показателей продуктов.
ИИ-копилоты для SQL, предназначенные для создания панелей управления доходами, анализа воронки продаж и отслеживания показателей продуктов.

2026 год: лучшие AI-ассистенты для SQL, занявшие верхние строчки рейтингов! XIX.AI собрал мощный набор инструментов, регулярно обновляемый на основе реальных тестов. Эти неотъемлемые инструменты помогают создавать точные дашборды с данными о доходах, анализировать каналы продаж и оперативно отслеживать показатели продуктов, значительно повышая производительность. Ознакомьтесь сейчас, чтобы найти идеальный инструмент для принятия решений на основе данных! 238 символов

9 инструментов
xix.ai
Музыкальная композиция Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен
Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен

2026 год: лучшие, топовые и высокооценённые инструменты ИИ для написания мелодий для черновиков песен! XIX.AI подобрал высокоэффективную коллекцию, меняющую правила игры, которая прошла строгие реальные испытания, чтобы обеспечить лучший опыт написания. Вы можете найти подробные сравнения бесплатных и платных версий, точные рейтинги и обязательные к использованию варианты, разработанные, чтобы помочь вам создавать потрясающие черновики песен без усилий и значительно повысить вашу творческую продуктивность. Исследуйте сейчас, чтобы найти свой идеальный инструмент!

8 инструментов
xix.ai
Комментарии (1)
0/500
KevinPerez
KevinPerez 28 февраля 2026 г., 5:00:44 GMT+03:00

Interesting! Making AI's 'thoughts' transparent could help build trust, but who gets to decide what's considered a 'reasonable' reasoning process? Feels like a crucial step, though the implementation details will be the real challenge. Hope it leads to practical tools, not just more guidelines. 🤔

OR