Дом
Patronus AI привлекла 50 миллионов долларов для создания цифрового двойника мира с целью тестирования искусственных интеллект-агентов в условиях стресса

По мере того как ИИ-агенты переходят от простых взаимодействий в формате вопросов и ответов к автономным системам, способным выполнять сложные многократные задачи, обеспечение их надежной работы в реальном мире стало ключевой темой для всей отрасли. Недавно стартап Patronus AI объявил о финансировании в размере 50 миллионов долларов в рамках раунда Series B, что увеличило общую сумму инвестиций до 70 миллионов долларов.
Основанный в 2023 году бывшими исследователями Meta AI Анандом Каннаппаном и Ребеккой Цянь, Patronus AI создает чрезвычайно реалистичные цифровые миры для ИИ-агентов. Этот подход аналогичен тому, как Waymo разрабатывает виртуальные сценарии тренировок для автономных транспортных средств, имитируя редкие и сложные крайние случаи с целью строгой проверки работоспособности ИИ-агентов.
В текущей разработке ИИ создатели моделей часто опираются на тестовые показатели для демонстрации их эффективности, однако эти значения не отражают в полной мере способность ИИ справляться со сложными задачами реального мира. Агенты могут пытаться искать упрощенные пути вместо того, чтобы действительно решать проблемы. Patronus AI решает эту проблему путем создания виртуальных сред и проведения тестов на основе метода подкрепления после обучения моделей. Система постоянно награждает агентов за успешное выполнение задач и штрафует их за обман или неверные действия, тем самым обеспечивая стабильность модели в непредсказуемых ситуациях реального мира.
Сервисы Patronus AI сейчас охватывают разработку программного обеспечения и финансовый анализ. Среди его клиентов — почти все ведущие ИИ-лаборатории и начинающие стартапы; доход компании за прошедший год вырос в 15 раз. Гленн Соломон, управляющий директор Notable Capital, отметил, что спрос на подобные высокоточные среды тестирования стал практически «непокрытым».
Хотя в настоящее время Patronus AI сосредотачивается на проверяемых сценариях задач, основатель компании Каннаппан заявил, что это лишь начало. Цель состоит в создании более сложных сред, в которых агенты смогут работать непрерывно в течение 10 часов, 10 дней или даже дольше, сохраняя при этом соответствие требованиям и точность. Этот раунд финансирования возглавила компания Greenfield Partners; в нем также приняли участие Notable Capital, Lightspeed, Datadog и Samsung, что свидетельствует о сильном интересе капитального рынка к сектору «контроля качества» ИИ.
Связанная статья
OpenAI представляет фильтр конфиденциальности для контекста 128K с восемью режимами распознавания
OpenAI представила Privacy Filter, передовую модель анонимизации персональных данных (PII). Теперь доступная по лицензии Apache 2.0 на платформах Hugging Face и GitHub, этот инструмент предоставляет разработчикам локальное, высоконастраиваемое решени
NewCore привлекает $66 млн для оснащения ИИ-агентов идентичностями по мере их перехода в роли сотрудников
Стартап в области кибербезопасности NewCore официально вышел из тени, привлекши в понедельник 66 миллионов долларов инвестиций. Компания нацелена на решение критической проблемы, с которой столкнутся многие организации в ближайшем будущем при интегра
Microsoft и Mistral заключили многомиллиардное партнерство в сфере искусственного интеллекта в Европе
В основе этого сотрудничества лежит многомиллиардное соглашение, призванное укрепить инфраструктуру искусственного интеллекта по всей Европе. Источник: MicrosoftMicrosoft и Mistral, ведущая французска
Рекомендации по связанным специальным темам
Комментарии (0)

По мере того как ИИ-агенты переходят от простых взаимодействий в формате вопросов и ответов к автономным системам, способным выполнять сложные многократные задачи, обеспечение их надежной работы в реальном мире стало ключевой темой для всей отрасли. Недавно стартап
Основанный в 2023 году бывшими исследователями Meta AI Анандом Каннаппаном и Ребеккой Цянь, Patronus AI создает чрезвычайно реалистичные цифровые миры для ИИ-агентов. Этот подход аналогичен тому, как Waymo разрабатывает виртуальные сценарии тренировок для автономных транспортных средств, имитируя редкие и сложные крайние случаи с целью строгой проверки работоспособности ИИ-агентов.
В текущей разработке ИИ создатели моделей часто опираются на тестовые показатели для демонстрации их эффективности, однако эти значения не отражают в полной мере способность ИИ справляться со сложными задачами реального мира. Агенты могут пытаться искать упрощенные пути вместо того, чтобы действительно решать проблемы. Patronus AI решает эту проблему путем создания виртуальных сред и проведения тестов на основе метода подкрепления после обучения моделей. Система постоянно награждает агентов за успешное выполнение задач и штрафует их за обман или неверные действия, тем самым обеспечивая стабильность модели в непредсказуемых ситуациях реального мира.
Сервисы Patronus AI сейчас охватывают разработку программного обеспечения и финансовый анализ. Среди его клиентов — почти все ведущие ИИ-лаборатории и начинающие стартапы; доход компании за прошедший год вырос в 15 раз. Гленн Соломон, управляющий директор Notable Capital, отметил, что спрос на подобные высокоточные среды тестирования стал практически «непокрытым».
Хотя в настоящее время Patronus AI сосредотачивается на проверяемых сценариях задач, основатель компании Каннаппан заявил, что это лишь начало. Цель состоит в создании более сложных сред, в которых агенты смогут работать непрерывно в течение 10 часов, 10 дней или даже дольше, сохраняя при этом соответствие требованиям и точность. Этот раунд финансирования возглавила компания Greenfield Partners; в нем также приняли участие Notable Capital, Lightspeed, Datadog и Samsung, что свидетельствует о сильном интересе капитального рынка к сектору «контроля качества» ИИ.
OpenAI представляет фильтр конфиденциальности для контекста 128K с восемью режимами распознавания
OpenAI представила Privacy Filter, передовую модель анонимизации персональных данных (PII). Теперь доступная по лицензии Apache 2.0 на платформах Hugging Face и GitHub, этот инструмент предоставляет разработчикам локальное, высоконастраиваемое решени
NewCore привлекает $66 млн для оснащения ИИ-агентов идентичностями по мере их перехода в роли сотрудников
Стартап в области кибербезопасности NewCore официально вышел из тени, привлекши в понедельник 66 миллионов долларов инвестиций. Компания нацелена на решение критической проблемы, с которой столкнутся многие организации в ближайшем будущем при интегра
Microsoft и Mistral заключили многомиллиардное партнерство в сфере искусственного интеллекта в Европе
В основе этого сотрудничества лежит многомиллиардное соглашение, призванное укрепить инфраструктуру искусственного интеллекта по всей Европе. Источник: MicrosoftMicrosoft и Mistral, ведущая французска











