Дом
xAI Grok 4.20 демонстрирует самый низкий в отрасли уровень галлюцинаций и ставит целостность выше производительности
В то время как гиганты в сфере ИИ лихорадочно вкладывают ресурсы в погоню за максимальными показателями производительности, компания xAI Илона Маска придерживается иного подхода, сосредоточившись на самой актуальной проблеме в этой области: фабрикации информации. Сегодня xAI официально представила Grok4.20Beta. Хотя по абсолютным показателям интеллекта она по-прежнему отстает от моделей высшего уровня, она установила новый отраслевой рекорд по ключевому показателю достоверности.

Согласно последней оценке Artificial Analysis, Grok4.20 набрал 48 баллов по индексу интеллекта в режиме логического мышления. Хотя он отстает от моделей « » и « » (обе набрали по 57 баллов), его показатели достоверности фактов особенно впечатляют:
Низкий уровень галлюцинаций: в тесте AA Omniscience Grok4.20 достиг 78% «уровня отсутствия галлюцинаций», установив новый рекорд.
Осознание собственных ограничений: сталкиваясь с вопросами, на которые не может ответить, модель больше не склонна выдумывать ложные факты, а вместо этого более точно признает: «Я не знаю». Такая честность имеет решающее значение для строгих офисных и исследовательских сред.
Техническая архитектура: матрица API «три в одном»
Чтобы удовлетворить разнообразные потребности, xAI запустила три варианта API:
Режим рассуждений: отдаёт приоритет глубокому логическому мышлению, а не скорости, что стало ключом к побитию рекорда по галлюцинациям на этот раз.
Стандартный режим: оптимизирован для быстрого отклика и рутинного взаимодействия.
Режим «Мультиагент»: поддерживает совместную работу нескольких экземпляров ИИ для решения сложных задач.
Рыночная стратегия: больше контента без дополнительных затрат
Помимо уникальной производительности, Grok4.20 также представляет агрессивную коммерческую стратегию:
Большой контекст: поддерживает окно контекста размером до 2 миллионов токенов, что позволяет ему одновременно обрабатывать целую книгу или обширную кодовую базу.
Ценовое преимущество: при цене от 2 до 6 долларов за миллион токенов система не только дешевле предыдущей версии Grok4, но и весьма конкурентоспособна среди современных западных моделей широкого применения.
Выпуск Grok4.20 отражает стратегический сдвиг xAI — компания больше не зацикливается на гонке за общим баллом в стремлении к AGI, а точно нацелена на решение «болевой точки» — «надежности корпоративного уровня». Как заявила оценочная организация, если другие модели стремятся стать «всеведущими пророками», то Grok4.20 стремится стать «помощником, который никогда не лжет».
Для пользователей с чрезвычайно высокими требованиями к точности данных Grok4.20 может стать третьим основным вариантом наряду с OpenAI и Google.
Связанная статья
Genesis AI решает сложные задачи с помощью одной модели, что стало событием, сравнимым с появлением ChatGPT
На фоне растущего мирового интереса к робототехнике компания Genesis AI представила GENE-26.5 — свою первую базовую модель робота. Этот запуск знаменует собой значительный прорыв в области универсальн
Microsoft представила первую разработанную собственными силами полнодуплексную модель искусственного интеллекта для распознавания речи, способную одновременно слушать и говорить на 16 языках
По данным технологического издания TestingCatalog, компания Microsoft в настоящее время тестирует свою первую собственную модель голосового взаимодействия в режиме реального времени — MAI Realtime. По
Apple представляет iOS 27 с локальным ИИ и расширением возможностей Siri благодаря партнерству с Google
Издание «The Information» недавно осветило стратегический подход Apple к интеграции искусственного интеллекта в будущую ОС 27. Используя модель Gemini от Google для обучения более эффективного и компа
Рекомендации по связанным специальным темам
Комментарии (0)
В то время как гиганты в сфере ИИ лихорадочно вкладывают ресурсы в погоню за максимальными показателями производительности, компания xAI Илона Маска придерживается иного подхода, сосредоточившись на самой актуальной проблеме в этой области: фабрикации информации. Сегодня xAI официально представила Grok4.20Beta. Хотя по абсолютным показателям интеллекта она по-прежнему отстает от моделей высшего уровня, она установила новый отраслевой рекорд по ключевому показателю достоверности.

Согласно последней оценке Artificial Analysis, Grok4.20 набрал 48 баллов по индексу интеллекта в режиме логического мышления. Хотя он отстает от моделей «
Низкий уровень галлюцинаций: в тесте AA Omniscience Grok4.20 достиг 78% «уровня отсутствия галлюцинаций», установив новый рекорд.
Осознание собственных ограничений: сталкиваясь с вопросами, на которые не может ответить, модель больше не склонна выдумывать ложные факты, а вместо этого более точно признает: «Я не знаю». Такая честность имеет решающее значение для строгих офисных и исследовательских сред.
Техническая архитектура: матрица API «три в одном»
Чтобы удовлетворить разнообразные потребности, xAI запустила три варианта API:
Режим рассуждений: отдаёт приоритет глубокому логическому мышлению, а не скорости, что стало ключом к побитию рекорда по галлюцинациям на этот раз.
Стандартный режим: оптимизирован для быстрого отклика и рутинного взаимодействия.
Режим «Мультиагент»: поддерживает совместную работу нескольких экземпляров ИИ для решения сложных задач.
Рыночная стратегия: больше контента без дополнительных затрат
Помимо уникальной производительности, Grok4.20 также представляет агрессивную коммерческую стратегию:
Большой контекст: поддерживает окно контекста размером до 2 миллионов токенов, что позволяет ему одновременно обрабатывать целую книгу или обширную кодовую базу.
Ценовое преимущество: при цене от 2 до 6 долларов за миллион токенов система не только дешевле предыдущей версии Grok4, но и весьма конкурентоспособна среди современных западных моделей широкого применения.
Выпуск Grok4.20 отражает стратегический сдвиг xAI — компания больше не зацикливается на гонке за общим баллом в стремлении к AGI, а точно нацелена на решение «болевой точки» — «надежности корпоративного уровня». Как заявила оценочная организация, если другие модели стремятся стать «всеведущими пророками», то Grok4.20 стремится стать «помощником, который никогда не лжет».
Для пользователей с чрезвычайно высокими требованиями к точности данных Grok4.20 может стать третьим основным вариантом наряду с OpenAI и Google.
Genesis AI решает сложные задачи с помощью одной модели, что стало событием, сравнимым с появлением ChatGPT
На фоне растущего мирового интереса к робототехнике компания Genesis AI представила GENE-26.5 — свою первую базовую модель робота. Этот запуск знаменует собой значительный прорыв в области универсальн
Microsoft представила первую разработанную собственными силами полнодуплексную модель искусственного интеллекта для распознавания речи, способную одновременно слушать и говорить на 16 языках
По данным технологического издания TestingCatalog, компания Microsoft в настоящее время тестирует свою первую собственную модель голосового взаимодействия в режиме реального времени — MAI Realtime. По
Apple представляет iOS 27 с локальным ИИ и расширением возможностей Siri благодаря партнерству с Google
Издание «The Information» недавно осветило стратегический подход Apple к интеграции искусственного интеллекта в будущую ОС 27. Используя модель Gemini от Google для обучения более эффективного и компа











