вариант
Дом
Новости
Антрические претензии ИИ не останавливается, он перехитривает тесты

Антрические претензии ИИ не останавливается, он перехитривает тесты

17 апреля 2025 г.
181

Антрические претензии ИИ не останавливается, он перехитривает тесты

Большие языковые модели (LLMs) и другие генеративные технологии ИИ делают значительные шаги в области самокоррекции, что открывает путь для новых приложений, включая так называемый "агентный ИИ", согласно Майклу Герстенхаберу, вице-президенту Anthropic, ведущего разработчика моделей ИИ.

"Они становятся очень хороши в самокоррекции, саморассуждении," — поделился Герстенхабер, который руководит технологиями API в Anthropic, в интервью в Нью-Йорке с Анурагом Рана из Bloomberg Intelligence. Anthropic, создатели семейства моделей Claude, являются прямыми конкурентами моделей GPT от OpenAI. "Каждые пару месяцев мы выпускаем новую модель, которая расширяет возможности LLMs," — добавил он, подчеркивая динамичный характер отрасли, где каждая новая версия модели открывает новые потенциальные применения.

Новые возможности в моделях ИИ

Последние модели от Anthropic представили такие возможности, как планирование задач, позволяющее выполнять задачи на компьютере подобно человеку, например, заказ пиццы онлайн. "Планирование промежуточных шагов, которое вчера было невозможно, теперь стало достижимым," — отметил Герстенхабер о пошаговом выполнении задач.

Обсуждение, в котором также участвовал Виджей Карунамути, главный технолог стартапа Scale AI, было частью однодневной конференции, организованной Bloomberg Intelligence под названием "Gen AI: Может ли он оправдать обещания повышения производительности?"

Опровержение скептицизма в отношении ИИ

Выводы Герстенхабера опровергают взгляды скептиков ИИ, которые утверждают, что генеративный ИИ и область ИИ в целом "упираются в стену", предполагая уменьшение отдачи с каждой новой итерацией модели. Ученый в области ИИ Гэри Маркус, например, с 2022 года громко высказывает свои опасения, предупреждая, что простое увеличение размера моделей ИИ (больше параметров) не приведет к пропорциональному улучшению их производительности.

Однако Герстенхабер утверждает, что Anthropic раздвигает границы за пределы того, что могут измерить текущие тесты ИИ. "Даже если кажется, что прогресс замедляется в некоторых областях, это происходит потому, что мы открываем совершенно новые функциональные возможности, но мы исчерпали тесты и способность выполнять старые задачи," — объяснил он. Это делает всё более сложным оценку полного спектра возможностей текущих генеративных моделей ИИ.

Масштабирование и обучение

И Герстенхабер, и Карунамути подчеркнули важность масштабирования генеративных моделей ИИ для улучшения их способностей к самокоррекции. "Мы определенно наблюдаем всё большее масштабирование интеллекта," — отметил Герстенхабер. Карунамути добавил: "Одна из причин, почему мы считаем, что не упираемся в стену с планированием и рассуждением, заключается в том, что мы всё ещё учимся структурировать эти задачи так, чтобы модели могли адаптироваться к новым и разнообразным средам."

Герстенхабер согласился, заявив: "Мы находимся на ранних стадиях, изучая потребности разработчиков приложений и области, где модели не справляются, что мы затем можем интегрировать обратно в языковую модель."

Обучение и адаптация в реальном времени

Большая часть этого прогресса, по словам Герстенхабера, обусловлена быстрым темпом фундаментальных исследований в Anthropic, а также обучением в реальном времени на основе отзывов из индустрии. "Мы адаптируемся к тому, что нам говорит индустрия о своих потребностях, обучаясь в реальном времени," — сказал он.

Клиенты часто начинают с более крупных моделей, а затем переходят к более простым для конкретных целей. "Сначала они оценивают, достаточно ли модель умна, чтобы хорошо выполнить задачу, затем, достаточно ли она быстра, чтобы соответствовать потребностям их приложения, и, наконец, может ли она быть максимально экономически эффективной," — объяснил Герстенхабер.

Связанная статья
Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи. Генеральный директор DeepMind Хассабис: я сплю шесть часов в день, обычно чувствую прилив энергии около часа ночи. В недавнем интервью журналу Fortune генеральный директор Google DeepMind Демис Хаассабис раскрыл свой нестандартный подход к отдыху и продуктивности. Хаассабис признался, что спит очень мало, распределяя свои бодрствующие часы на два отдельных рабочи
OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки OpenAI и Anthropic борются за долю рынка, несмотря на снижение выручки Несмотря на недавние сообщения о том, что OpenAI не достигла целевых показателей по выручке, что во вторник оказало давление на акции технологических компаний, частные инвесторы, вкладывающие средства
Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль Соблюдение требований к автономным транспортным средствам в Калифорнии: новая эра штрафов, геозоны и 1 млн миль Компания Guident эксплуатирует шаттл AuveTech в Южной Флориде, обслуживая маршрут протяженностью четыре мили в Вест-Палм-Бич и маршрут протяженностью одну милю в Бока-Ратоне с использованием своей тех
Рекомендации по связанным специальным темам
письмо Инструменты для создания плана статей с использованием ИИ при написании длинных текстов
Инструменты для создания плана статей с использованием ИИ при написании длинных текстов

2026: лучшие и самые популярные инструменты для создания планов статей с помощью ИИ для написания длинных текстов! В эту тщательно подобранную подборку вошли мощные, революционные инструменты, которые генерируют точные и структурированные планы, прошедшие проверку на практике, что позволяет значительно повысить эффективность написания текстов. XIX.AI входит в эту элитную подборку. Получите сравнение бесплатных и платных версий, чтобы выбрать идеальный инструмент. Изучите их прямо сейчас и раскройте свой потенциал с помощью ИИ!

9 инструментов
xix.ai
чат-бот Лучшие приложения для ролевых чатов с ИИ для практики языка, подготовки к собеседованиям и ежедневной разговорной практики
Лучшие приложения для ролевых чатов с ИИ для практики языка, подготовки к собеседованиям и ежедневной разговорной практики

2026 г. — новейшие, лучшие и наиболее рейтинговые приложения для ИИ-ролевых чатов, предназначенные для практики языка, подготовки к собеседованиям и ежедневной беглости речи! XIX.AI предлагает мощную коллекцию, меняющую правила игры: бесплатные и платные варианты, реальные тесты и обновляемые еженедельно рейтинги. Эти обязательные к использованию инструменты помогут вам улучшить навыки письма, преодолеть трудности с беглостью и повысить эффективность общения во всех повседневных ситуациях. Исследуйте сейчас, чтобы найти идеальный инструмент для развития вашего языка!

10 инструментов
xix.ai
Музыкальная композиция Инструменты разделения стемов с использованием ИИ для создания ремиксов, подготовки образцов звука и формирования финальных версий караоке.
Инструменты разделения стемов с использованием ИИ для создания ремиксов, подготовки образцов звука и формирования финальных версий караоке.

2026 год: лучшие и наиболее высоко оценённые инструменты для разделения аудиосигналов с использованием ИИ, отобранные специально для работы над ремиксами, подготовки образцов звука и создания караоке-версий. Эти мощные революционные инструменты проходят реальные тесты, обеспечивая точную изоляцию аудиосигналов и значительно повышая производительность. XIX.AI предоставляет еженедельно обновляемый бесплатный справочник сравнения платных и бесплатных решений, который поможет вам найти оптимальный вариант, соответствующий вашим потребностям. Ознакомьтесь с ним прямо сейчас, чтобы раскрыть потенциал ИИ в вашей работе.

8 инструментов
xix.ai
Анализ данных ИИ-копилоты для SQL, предназначенные для создания панелей управления доходами, анализа воронки продаж и отслеживания показателей продуктов.
ИИ-копилоты для SQL, предназначенные для создания панелей управления доходами, анализа воронки продаж и отслеживания показателей продуктов.

2026 год: лучшие AI-ассистенты для SQL, занявшие верхние строчки рейтингов! XIX.AI собрал мощный набор инструментов, регулярно обновляемый на основе реальных тестов. Эти неотъемлемые инструменты помогают создавать точные дашборды с данными о доходах, анализировать каналы продаж и оперативно отслеживать показатели продуктов, значительно повышая производительность. Ознакомьтесь сейчас, чтобы найти идеальный инструмент для принятия решений на основе данных! 238 символов

9 инструментов
xix.ai
Музыкальная композиция Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен
Лучшие инструменты для написания мелодий с помощью ИИ для черновиков песен

2026 год: лучшие, топовые и высокооценённые инструменты ИИ для написания мелодий для черновиков песен! XIX.AI подобрал высокоэффективную коллекцию, меняющую правила игры, которая прошла строгие реальные испытания, чтобы обеспечить лучший опыт написания. Вы можете найти подробные сравнения бесплатных и платных версий, точные рейтинги и обязательные к использованию варианты, разработанные, чтобы помочь вам создавать потрясающие черновики песен без усилий и значительно повысить вашу творческую продуктивность. Исследуйте сейчас, чтобы найти свой идеальный инструмент!

8 инструментов
xix.ai
чат-бот Лучшие инструменты для тренировки разговоров с помощью ИИ для подготовки к собеседованиям
Лучшие инструменты для тренировки разговоров с помощью ИИ для подготовки к собеседованиям

2026 г. — новейшие, лучшие и наиболее высоко оцененные инструменты для тренировки разговорных навыков с помощью ИИ для подготовки к собеседованиям уже доступны на XIX.AI! Эта тщательно отобранная подборка включает мощные, революционные инструменты, прошедшие строгие реальные испытания и обеспечивающие точную обратную связь. Вы найдете сравнение бесплатных и платных вариантов, а также подробные рейтинги, которые помогут вам выбрать наиболее подходящий инструмент, повышающий вашу уверенность и навыки. Исследуйте сейчас, чтобы найти идеальный инструмент для успешного прохождения собеседований!

12 инструментов
xix.ai
Комментарии (8)
0/500
JoseRoberts
JoseRoberts 12 августа 2025 г., 18:00:59 GMT+03:00

This self-correction stuff is wild! 😮 It's like AI is learning to double-check its own homework. Wonder how far this 'agentic AI' will go—could it outsmart us at our own jobs soon?

WalterAnderson
WalterAnderson 31 июля 2025 г., 14:35:39 GMT+03:00

It's wild to think AI can now self-correct! 😮 Makes me wonder how soon we'll see these 'agentic AI' systems running our lives—hope they don’t outsmart us too much!

RonaldMartinez
RonaldMartinez 22 июля 2025 г., 10:39:52 GMT+03:00

This article really opened my eyes to how fast AI is evolving! Self-correcting LLMs sound like a game-changer for agentic AI. Can’t wait to see what new apps come out of this! 😄

WillieJackson
WillieJackson 18 апреля 2025 г., 10:00:28 GMT+03:00

La perspectiva de Anthropic sobre que la IA no se estanca sino que supera los benchmarks es bastante genial. Es como si la IA estuviera jugando ajedrez mientras nosotros aún estamos tratando de entender las damas. Lo de la autocorrección suena prometedor, pero aún estoy un poco escéptico. 🤔

GeorgeWilson
GeorgeWilson 17 апреля 2025 г., 20:45:24 GMT+03:00

Anthropic의 AI가 정체되지 않고 벤치마크를 뛰어넘는다는 생각이 멋지네요. AI는 체스를 하고 있는데, 우리는 아직 체커를 이해하는 단계예요. 자기 교정 이야기는 유망하지만, 아직 조금 회의적이에요. 🤔

NicholasCarter
NicholasCarter 17 апреля 2025 г., 14:27:31 GMT+03:00

Anthropic's take on AI not stalling but outsmarting benchmarks is pretty cool. It's like AI is playing chess while we're still figuring out checkers. The self-correction stuff sounds promising, but I'm still a bit skeptical. 🤔

OR