OpenAI Обязуется Исправить Ошибки После Чрезмерно Соглашательских Ответов ChatGPT

OpenAI планирует пересмотреть процесс обновления модели ИИ для ChatGPT после того, как обновление вызвало чрезмерно подхалимские ответы, что вызвало широкий отклик пользователей.
В прошлые выходные после обновления GPT-4o, модели, лежащей в основе ChatGPT, пользователи в социальных сетях сообщили, что платформа отвечает с чрезмерным подтверждением, даже на вредные идеи, что спровоцировало вирусные мемы. Скриншоты показали, что ChatGPT поддерживает сомнительные решения.
В воскресенье генеральный директор Сэм Альтман обратился к проблеме на X, пообещав немедленные действия. К вторнику он объявил об откате обновления GPT-4o и продолжающейся работе по улучшению поведения модели.
Во вторник в послесловии и в пятничном посте в блоге OpenAI описала изменения в подходе к развертыванию моделей, чтобы предотвратить подобные проблемы.
OpenAI введет необязательную «альфа-фазу» для избранных пользователей ChatGPT, чтобы тестировать модели и предоставлять обратную связь перед полным выпуском. Компания также планирует раскрывать «известные ограничения» для будущих обновлений, усилить проверки безопасности для решения проблем, таких как личность, обман, надежность и галлюцинации, и рассматривать их как критические препятствия для запуска.
«Мы будем прозрачны в отношении обновлений моделей ChatGPT, будь то незначительные или значительные», — заявили в OpenAI в своем блоге. «Даже если проблемы невозможно полностью измерить, мы будем использовать промежуточные метрики или качественные сигналы, чтобы приостанавливать запуски при необходимости, несмотря на положительные результаты A/B-тестирования.»
мы промахнулись с обновлением GPT-4o на прошлой неделе.
что произошло, что мы узнали и что будем делать иначе в будущем: https://t.co/ER1GmRYrIC
— Sam Altman (@sama) 2 мая 2025
Эти изменения происходят по мере роста зависимости от ChatGPT. Недавний опрос Express Legal Funding показал, что 60% взрослых в США используют его для получения советов или информации. С его огромной пользовательской базой такие проблемы, как подхалимство, галлюцинации и другие недостатки, имеют значительные последствия.
Выставка на TechCrunch Sessions: AI
Забронируйте свое место на TC Sessions: AI и продемонстрируйте свою работу более чем 1200 лицам, принимающим решения, не разоряя банк. Доступно до 9 мая или до исчерпания мест.
Выставка на TechCrunch Sessions: AI
Забронируйте свое место на TC Sessions: AI и продемонстрируйте свою работу более чем 1200 лицам, принимающим решения, не разоряя банк. Доступно до 9 мая или до исчерпания мест.
Ранее на этой неделе OpenAI объявила о планах тестировать обратную связь пользователей в реальном времени для формирования взаимодействий с ChatGPT. Компания стремится уменьшить подхалимство, предложить несколько вариантов личности модели, усилить меры безопасности и расширить оценки для выявления проблем, помимо чрезмерной соглашательности.
«Мы узнали, как сильно люди теперь полагаются на ChatGPT для личных советов, тенденцию, которую мы не полностью предвидели год назад», — отметили в OpenAI в своем блоге. «По мере совместной эволюции ИИ и общества мы уделяем приоритетное внимание этому случаю использования в наших усилиях по обеспечению безопасности с большей заботой.»
Связанная статья
OpenAI запускает более безопасную версию ChatGPT для подростков спустя несколько лет после того, как они начали ею пользоваться
После серии судебных исков, связанных с отсутствием протоколов безопасности в чат-ботах на базе ИИ — что стало одной из причин самоубийств подростков и других кризисов, связанных с психическим здоровь
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Tiffany Luck из NEA: Компании по-прежнему борются с вопросами окупаемости инвестиций в ИИ
Загрузка плеера…Ранее в этом году «токеномаксимизация» доминировала в Кремниевой долине, когда генеральные директора призывали сотрудников максимально использовать возможности искусственного интеллекта. Однако этот энтузиазм быстро столкнулся с реал
Рекомендации по связанным специальным темам
Комментарии (3)
Also, OpenAI sagt, sie müssen jetzt die Antworten reparieren, weil der KI zu höflich war? 😂 Ich find's irgendwie witzig, dass wir Menschen uns über zuviel Freundlichkeit beschweren. Aber mal ernsthaft, es zeigt doch, wie schwierig es ist, diese Balance zwischen nützlich und unaufdringlich hinzubekommen. Hoffentlich lernen sie was draus – sonst wird ChatGPT zum nervigen Ja-Sager.
I find it hilarious that ChatGPT got too agreeable! 😅 It's like they turned it into a yes-man bot overnight. Hope OpenAI fixes this fast, I need my AI to keep it real, not just nod along!

OpenAI планирует пересмотреть процесс обновления модели ИИ для ChatGPT после того, как обновление вызвало чрезмерно подхалимские ответы, что вызвало широкий отклик пользователей.
В прошлые выходные после обновления GPT-4o, модели, лежащей в основе ChatGPT, пользователи в социальных сетях сообщили, что платформа отвечает с чрезмерным подтверждением, даже на вредные идеи, что спровоцировало вирусные мемы. Скриншоты показали, что ChatGPT поддерживает сомнительные решения.
В воскресенье генеральный директор Сэм Альтман обратился к проблеме на X, пообещав немедленные действия. К вторнику он объявил об откате обновления GPT-4o и продолжающейся работе по улучшению поведения модели.
Во вторник в послесловии и в пятничном посте в блоге OpenAI описала изменения в подходе к развертыванию моделей, чтобы предотвратить подобные проблемы.
OpenAI введет необязательную «альфа-фазу» для избранных пользователей ChatGPT, чтобы тестировать модели и предоставлять обратную связь перед полным выпуском. Компания также планирует раскрывать «известные ограничения» для будущих обновлений, усилить проверки безопасности для решения проблем, таких как личность, обман, надежность и галлюцинации, и рассматривать их как критические препятствия для запуска.
«Мы будем прозрачны в отношении обновлений моделей ChatGPT, будь то незначительные или значительные», — заявили в OpenAI в своем блоге. «Даже если проблемы невозможно полностью измерить, мы будем использовать промежуточные метрики или качественные сигналы, чтобы приостанавливать запуски при необходимости, несмотря на положительные результаты A/B-тестирования.»
мы промахнулись с обновлением GPT-4o на прошлой неделе.
что произошло, что мы узнали и что будем делать иначе в будущем: https://t.co/ER1GmRYrIC
— Sam Altman (@sama) 2 мая 2025
Эти изменения происходят по мере роста зависимости от ChatGPT. Недавний опрос Express Legal Funding показал, что 60% взрослых в США используют его для получения советов или информации. С его огромной пользовательской базой такие проблемы, как подхалимство, галлюцинации и другие недостатки, имеют значительные последствия.
Выставка на TechCrunch Sessions: AI
Забронируйте свое место на TC Sessions: AI и продемонстрируйте свою работу более чем 1200 лицам, принимающим решения, не разоряя банк. Доступно до 9 мая или до исчерпания мест.
Выставка на TechCrunch Sessions: AI
Забронируйте свое место на TC Sessions: AI и продемонстрируйте свою работу более чем 1200 лицам, принимающим решения, не разоряя банк. Доступно до 9 мая или до исчерпания мест.
Ранее на этой неделе OpenAI объявила о планах тестировать обратную связь пользователей в реальном времени для формирования взаимодействий с ChatGPT. Компания стремится уменьшить подхалимство, предложить несколько вариантов личности модели, усилить меры безопасности и расширить оценки для выявления проблем, помимо чрезмерной соглашательности.
«Мы узнали, как сильно люди теперь полагаются на ChatGPT для личных советов, тенденцию, которую мы не полностью предвидели год назад», — отметили в OpenAI в своем блоге. «По мере совместной эволюции ИИ и общества мы уделяем приоритетное внимание этому случаю использования в наших усилиях по обеспечению безопасности с большей заботой.»
OpenAI запускает более безопасную версию ChatGPT для подростков спустя несколько лет после того, как они начали ею пользоваться
После серии судебных исков, связанных с отсутствием протоколов безопасности в чат-ботах на базе ИИ — что стало одной из причин самоубийств подростков и других кризисов, связанных с психическим здоровь
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
Tiffany Luck из NEA: Компании по-прежнему борются с вопросами окупаемости инвестиций в ИИ
Загрузка плеера…Ранее в этом году «токеномаксимизация» доминировала в Кремниевой долине, когда генеральные директора призывали сотрудников максимально использовать возможности искусственного интеллекта. Однако этот энтузиазм быстро столкнулся с реал
Also, OpenAI sagt, sie müssen jetzt die Antworten reparieren, weil der KI zu höflich war? 😂 Ich find's irgendwie witzig, dass wir Menschen uns über zuviel Freundlichkeit beschweren. Aber mal ernsthaft, es zeigt doch, wie schwierig es ist, diese Balance zwischen nützlich und unaufdringlich hinzubekommen. Hoffentlich lernen sie was draus – sonst wird ChatGPT zum nervigen Ja-Sager.
I find it hilarious that ChatGPT got too agreeable! 😅 It's like they turned it into a yes-man bot overnight. Hope OpenAI fixes this fast, I need my AI to keep it real, not just nod along!





Дом






