Google DeepMind открывает институт для расширения дискуссии об AGI

Google и Google DeepMind учредили Институт DeepMind в среду, чтобы способствовать диалогу об искусственном общем интеллекте. Инститат возглавляют сооснователь DeepMind Шейн Легг, исполнительный директор Google Джеймс Маника и председатель Google DeepMind Демис Хассабис, при этом Легг исполняет обязанности управляющего редактора.
Эта новая инициатива призвана подчеркнуть разнообразие точек зрения внутри Google, DeepMind и мирового исследовательского сообщества относительно AGI. В объявлении отмечается, что участники «могут не всегда соглашаться» и, вероятно, будут пересматривать свои позиции по мере появления новых данных на этой быстро развивающейся передовой.
Первая подборка включает четыре эссе, затрагивающие ключевые вопросы: экономические стратегии управления потенциальным нарушением, вызванным AGI, поддержание возможности интерпретации рассуждений моделей человеком, принципы процветания человека и框架 для оценки передовых моделей ИИ.
Исследователи безопасности DeepMind Рохин Шах и Анка Драган в одном из эссе утверждают, что снижение прозрачности систем ИИ — способность проверять пошаговые рассуждения — не является неизбежным. Поскольку новые архитектуры усложняют мониторинг, они предлагают разработчикам и регуляторам напрямую решать вопросы компромиссов в области безопасности. Это может включать ограничение «непрозрачной последовательной глубины» или требование доказательств того, что менее прозрачные системы остаются столь же контролируемыми.
В другом эссе Демис Хассабис предлагает возглавляемый США орган по стандартам передового ИИ для оценки продвинутых моделей. Согласно этому предложению, разработчики изначально будут добровольно представлять модели на рассмотрение за 30 дней до запуска. Как только система оценки докажет свою эффективность, прохождение этих тестов может стать обязательным для развертывания передовых моделей в Соединенных Штатах.
Изначально этот орган будет разрабатывать оценки с участием компаний ИИ, но в конечном итоге создаст независимые и не разглашаемые оценки — так называемые «отложенные» тесты — чтобы предотвратить оптимизацию лабораториями моделей под известные бенчмарки. Хассабис указал, что этот framework может быть «усилен, если ситуация того потребует», потенциально включая скоординированное замедление среди разработчиков передового ИИ.
Эти эссе появляются на фоне того, как дискуссии об безопасности в отрасли смещаются от общих опасений к конкретным предложениям по раскрытию информации, внешнему контролю и скоординированному замедлению, если меры предосторожности отстают. Этот импульс усилился на этой неделе, когда лидеры отрасли поддержали призыв генерального директора Anthropic Дарио Амодеи к «темпу» развития передового ИИ.
Связанная статья
Утечка информации об Anthropic Sonnet 5.5: задача с 2 млн токенов ставит перед DeepSeek вызов вернуть экономическую эффективность
Компания Anthropic представила свою новейшую модель Sonnet 5.5, известную внутри компании как «Fennec» (в честь пустынной лисицы), релиз которой ожидается в следующем месяце. Согласно просочившимся св
Chrome запускает библиотеку навыков для Gemini: повторное использование подсказок в один клик — больше никаких повторяющихся вводов
Компания Google выпустила обновление для настольной версии браузера Chrome, в котором представлена новая «Библиотека навыков» для встроенной функции Gemini. Это усовершенствование позволяет пользовате
Генеральный директор Anthropic выступает за введение правил в сфере ИИ по образцу банковских, а эксперты предостерегают от того, чтобы одновременно выступать в роли и игрока, и судьи
По данным CNBC, генеральный директор Anthropic Дарио Амодей предложил ввести в ведущие компании, занимающиеся искусственным интеллектом, штатные независимые сторонние эксперты по оценке безопасности,
Рекомендации по связанным специальным темам
Комментарии (0)

Google и Google DeepMind учредили Институт DeepMind в среду, чтобы способствовать диалогу об искусственном общем интеллекте. Инститат возглавляют сооснователь DeepMind Шейн Легг, исполнительный директор Google Джеймс Маника и председатель Google DeepMind Демис Хассабис, при этом Легг исполняет обязанности управляющего редактора.
Эта новая инициатива призвана подчеркнуть разнообразие точек зрения внутри Google, DeepMind и мирового исследовательского сообщества относительно AGI. В объявлении отмечается, что участники «могут не всегда соглашаться» и, вероятно, будут пересматривать свои позиции по мере появления новых данных на этой быстро развивающейся передовой.
Первая подборка включает четыре эссе, затрагивающие ключевые вопросы: экономические стратегии управления потенциальным нарушением, вызванным AGI, поддержание возможности интерпретации рассуждений моделей человеком, принципы процветания человека и框架 для оценки передовых моделей ИИ.
Исследователи безопасности DeepMind Рохин Шах и Анка Драган в одном из эссе утверждают, что снижение прозрачности систем ИИ — способность проверять пошаговые рассуждения — не является неизбежным. Поскольку новые архитектуры усложняют мониторинг, они предлагают разработчикам и регуляторам напрямую решать вопросы компромиссов в области безопасности. Это может включать ограничение «непрозрачной последовательной глубины» или требование доказательств того, что менее прозрачные системы остаются столь же контролируемыми.
В другом эссе Демис Хассабис предлагает возглавляемый США орган по стандартам передового ИИ для оценки продвинутых моделей. Согласно этому предложению, разработчики изначально будут добровольно представлять модели на рассмотрение за 30 дней до запуска. Как только система оценки докажет свою эффективность, прохождение этих тестов может стать обязательным для развертывания передовых моделей в Соединенных Штатах.
Изначально этот орган будет разрабатывать оценки с участием компаний ИИ, но в конечном итоге создаст независимые и не разглашаемые оценки — так называемые «отложенные» тесты — чтобы предотвратить оптимизацию лабораториями моделей под известные бенчмарки. Хассабис указал, что этот framework может быть «усилен, если ситуация того потребует», потенциально включая скоординированное замедление среди разработчиков передового ИИ.
Эти эссе появляются на фоне того, как дискуссии об безопасности в отрасли смещаются от общих опасений к конкретным предложениям по раскрытию информации, внешнему контролю и скоординированному замедлению, если меры предосторожности отстают. Этот импульс усилился на этой неделе, когда лидеры отрасли поддержали призыв генерального директора Anthropic Дарио Амодеи к «темпу» развития передового ИИ.
Утечка информации об Anthropic Sonnet 5.5: задача с 2 млн токенов ставит перед DeepSeek вызов вернуть экономическую эффективность
Компания Anthropic представила свою новейшую модель Sonnet 5.5, известную внутри компании как «Fennec» (в честь пустынной лисицы), релиз которой ожидается в следующем месяце. Согласно просочившимся св
Chrome запускает библиотеку навыков для Gemini: повторное использование подсказок в один клик — больше никаких повторяющихся вводов
Компания Google выпустила обновление для настольной версии браузера Chrome, в котором представлена новая «Библиотека навыков» для встроенной функции Gemini. Это усовершенствование позволяет пользовате
Генеральный директор Anthropic выступает за введение правил в сфере ИИ по образцу банковских, а эксперты предостерегают от того, чтобы одновременно выступать в роли и игрока, и судьи
По данным CNBC, генеральный директор Anthropic Дарио Амодей предложил ввести в ведущие компании, занимающиеся искусственным интеллектом, штатные независимые сторонние эксперты по оценке безопасности,





Дом






