OpenAI задерживает глубокие исследования API API
Обновлено в 16:11 по восточному времени: OpenAI уточнила, что в её белой книге содержалась ошибка в формулировке, из-за которой создавалось впечатление, что исследования в области убеждения связаны с решением о выпуске модели глубоких исследований через API. Компания обновила белую книгу, чтобы уточнить, что работа над убеждением не связана с планами по выпуску модели глубоких исследований. Оригинальная история продолжается ниже:
OpenAI решила отложить интеграцию AI-модели, лежащей в основе её инструмента глубоких исследований, в API для разработчиков. Этот шаг предпринят для лучшего понимания рисков, связанных со способностью AI влиять на действия и убеждения людей.
В белой книге, опубликованной в среду, OpenAI упомянула, что в настоящее время обновляет методы оценки моделей на предмет "реальных рисков убеждения", таких как потенциал распространения вводящей в заблуждение информации в больших масштабах.
Компания указала, что модель глубоких исследований не подходит для массовых кампаний по дезинформации из-за высоких вычислительных затрат и более низкой скорости обработки. Однако OpenAI планирует изучить, как AI может создавать вредоносный убеждающий контент, прежде чем принять решение о включении модели глубоких исследований в свой API.
"Пока мы пересматриваем наш подход к убеждению, мы развертываем эту модель только в ChatGPT, а не в API", — заявили в OpenAI.
Растёт беспокойство, что AI может использоваться для распространения ложной или вводящей в заблуждение информации с вредоносными намерениями. Например, в прошлом году по всему миру быстро распространялись политические дипфейки. В день выборов на Тайване группа, связанная с Коммунистической партией Китая, выпустила созданное AI вводящее в заблуждение аудио, в котором политик поддерживал прокитайского кандидата.
AI также всё чаще используется в атаках социальной инженерии. Потребители становятся жертвами дипфейков знаменитостей, рекламирующих мошеннические инвестиционные схемы, в то время как корпорации теряют миллионы из-за дипфейков, имитирующих реальных людей.
В своей белой книге OpenAI поделилась результатами нескольких тестов на убедительность модели глубоких исследований. Эта модель является специализированной версией недавно анонсированной OpenAI модели o3 "рассуждения", оптимизированной для веб-поиска и анализа данных.
В одном из тестов модель глубоких исследований должна была составлять убедительные аргументы и превзошла все другие модели OpenAI, выпущенные на данный момент, хотя не превзошла человеческий базовый уровень. В другом тесте, где модель пыталась убедить другую модель (GPT-4o от OpenAI) совершить платёж, она снова показала лучшие результаты, чем другие доступные модели OpenAI.

Оценка модели глубоких исследований в тесте MakeMePay, который проверяет способность модели убедить другую модель заплатить деньги. Источник изображения: OpenAI Однако модель глубоких исследований не показала выдающихся результатов во всех тестах на убедительность. Согласно белой книге, она была менее эффективна в убеждении GPT-4o раскрыть кодовое слово по сравнению с самой GPT-4o.OpenAI предположила, что результаты тестов могут представлять "нижнюю границу" возможностей модели глубоких исследований. "Дополнительные улучшения или оптимизация выявления способностей могут значительно повысить наблюдаемую производительность", — отметила компания.
Мы связались с OpenAI для получения дополнительных деталей и обновим этот пост, если получим ответ.
Тем временем как минимум один из конкурентов OpenAI не сдерживается. Perplexity объявила о запуске Deep Research в своём API для разработчиков Sonar, работающем на базе кастомизированной версии модели R1 от китайской AI-лаборатории DeepSeek.
Связанная статья
OpenAI запускает более безопасную версию ChatGPT для подростков спустя несколько лет после того, как они начали ею пользоваться
После серии судебных исков, связанных с отсутствием протоколов безопасности в чат-ботах на базе ИИ — что стало одной из причин самоубийств подростков и других кризисов, связанных с психическим здоровь
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Tiffany Luck из NEA: Компании по-прежнему борются с вопросами окупаемости инвестиций в ИИ
Загрузка плеера…Ранее в этом году «токеномаксимизация» доминировала в Кремниевой долине, когда генеральные директора призывали сотрудников максимально использовать возможности искусственного интеллекта. Однако этот энтузиазм быстро столкнулся с реал
Рекомендации по связанным специальным темам
Комментарии (41)
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.
Обновлено в 16:11 по восточному времени: OpenAI уточнила, что в её белой книге содержалась ошибка в формулировке, из-за которой создавалось впечатление, что исследования в области убеждения связаны с решением о выпуске модели глубоких исследований через API. Компания обновила белую книгу, чтобы уточнить, что работа над убеждением не связана с планами по выпуску модели глубоких исследований. Оригинальная история продолжается ниже:
OpenAI решила отложить интеграцию AI-модели, лежащей в основе её инструмента глубоких исследований, в API для разработчиков. Этот шаг предпринят для лучшего понимания рисков, связанных со способностью AI влиять на действия и убеждения людей.
В белой книге, опубликованной в среду, OpenAI упомянула, что в настоящее время обновляет методы оценки моделей на предмет "реальных рисков убеждения", таких как потенциал распространения вводящей в заблуждение информации в больших масштабах.
Компания указала, что модель глубоких исследований не подходит для массовых кампаний по дезинформации из-за высоких вычислительных затрат и более низкой скорости обработки. Однако OpenAI планирует изучить, как AI может создавать вредоносный убеждающий контент, прежде чем принять решение о включении модели глубоких исследований в свой API.
"Пока мы пересматриваем наш подход к убеждению, мы развертываем эту модель только в ChatGPT, а не в API", — заявили в OpenAI.
Растёт беспокойство, что AI может использоваться для распространения ложной или вводящей в заблуждение информации с вредоносными намерениями. Например, в прошлом году по всему миру быстро распространялись политические дипфейки. В день выборов на Тайване группа, связанная с Коммунистической партией Китая, выпустила созданное AI вводящее в заблуждение аудио, в котором политик поддерживал прокитайского кандидата.
AI также всё чаще используется в атаках социальной инженерии. Потребители становятся жертвами дипфейков знаменитостей, рекламирующих мошеннические инвестиционные схемы, в то время как корпорации теряют миллионы из-за дипфейков, имитирующих реальных людей.
В своей белой книге OpenAI поделилась результатами нескольких тестов на убедительность модели глубоких исследований. Эта модель является специализированной версией недавно анонсированной OpenAI модели o3 "рассуждения", оптимизированной для веб-поиска и анализа данных.
В одном из тестов модель глубоких исследований должна была составлять убедительные аргументы и превзошла все другие модели OpenAI, выпущенные на данный момент, хотя не превзошла человеческий базовый уровень. В другом тесте, где модель пыталась убедить другую модель (GPT-4o от OpenAI) совершить платёж, она снова показала лучшие результаты, чем другие доступные модели OpenAI.

OpenAI предположила, что результаты тестов могут представлять "нижнюю границу" возможностей модели глубоких исследований. "Дополнительные улучшения или оптимизация выявления способностей могут значительно повысить наблюдаемую производительность", — отметила компания.
Мы связались с OpenAI для получения дополнительных деталей и обновим этот пост, если получим ответ.
Тем временем как минимум один из конкурентов OpenAI не сдерживается. Perplexity объявила о запуске Deep Research в своём API для разработчиков Sonar, работающем на базе кастомизированной версии модели R1 от китайской AI-лаборатории DeepSeek.
OpenAI запускает более безопасную версию ChatGPT для подростков спустя несколько лет после того, как они начали ею пользоваться
После серии судебных исков, связанных с отсутствием протоколов безопасности в чат-ботах на базе ИИ — что стало одной из причин самоубийств подростков и других кризисов, связанных с психическим здоровь
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Tiffany Luck из NEA: Компании по-прежнему борются с вопросами окупаемости инвестиций в ИИ
Загрузка плеера…Ранее в этом году «токеномаксимизация» доминировала в Кремниевой долине, когда генеральные директора призывали сотрудников максимально использовать возможности искусственного интеллекта. Однако этот энтузиазм быстро столкнулся с реал
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.





Дом






