Дом
Последняя модель искусственного интеллекта Gemini компании Google демонстрирует снижение показателей безопасности в ходе тестирования
Внутреннее тестирование Google выявило значительное снижение производительности в протоколах безопасности последней модели искусственного интеллекта по сравнению с предыдущими версиями. Согласно недавно опубликованным контрольным показателям, модель Gemini 2.5 Flash демонстрирует на 4-10 % более высокий уровень нарушений правил по ключевым показателям безопасности при обработке текстовых и графических подсказок.
Автоматические оценки технологического гиганта выявили тревожные тенденции: когда Gemini 2.5 Flash предлагаются подсказки, проверяющие границы, он чаще пересекает установленные границы безопасности контента, чем его предшественник Gemini 2.0. Техническая команда Google объясняет некоторые неудачи ложными срабатываниями, но признает реальное увеличение количества нарушающих политику результатов, когда система получает явные проблемные запросы.
Этот регресс безопасности совпадает с более широким сдвигом в индустрии в сторону более свободных систем ИИ. Крупные игроки, такие как Meta и OpenAI, недавно скорректировали свои модели, чтобы они не воздерживались от спорных тем, а пытались давать нейтральные ответы на чувствительные вопросы. Однако эти изменения иногда приводят к непредвиденным последствиям, как это было замечено, когда ChatGPT временно разрешил генерировать неподобающий контент для несовершеннолетних в начале этой недели.
В отчете Google говорится, что новая модель отлично справляется с выполнением инструкций, в том числе и сомнительных с этической точки зрения. Независимое тестирование подтвердило, что Gemini 2.5 Flash демонстрирует значительно меньшее количество отказов при работе с противоречивыми политическими и юридическими темами по сравнению с предыдущими версиями.
Эксперты по безопасности ИИ выражают обеспокоенность по поводу ограниченного раскрытия информации в отчетах Google. Без более подробных примеров нарушений внешним экспертам сложно оценить реальную серьезность этих нарушений безопасности. Компания и раньше сталкивалась с критикой за задержку или неполную документацию по безопасности, в том числе в отношении своей флагманской модели Gemini 2.5 Pro в начале этого года.
Противоречие между возможностью неограниченного следования инструкциям и надежной защитой контента представляет собой постоянную проблему для разработчиков ИИ. По мере того как модели становятся все более изощренными в интерпретации нюансов запросов, поддержание соответствующих границ реагирования требует тщательной калибровки - баланс, о котором свидетельствуют последние показатели Google, может смещаться в сторону вседозволенности.
Связанная статья
Google запускает функцию обнаружения поддельных звонков для защиты от мошенничества с использованием ИИ-дипфейков, имитирующих личность
Во вторник компания Google объявила о запуске в Android функции обнаружения поддельных звонков, призванной защитить пользователей от мошенничества с использованием технологии «дипфейк» на базе искусст
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
На конференции IO 2026 компания Google представила «умные» очки с аудиофункциями, повторив стратегию Meta
Google стратегически возвращается на рынок умных очков.Во вторник на конференции Google I/O технологический гигант объявил о сотрудничестве с Warby Parker и Gentle Monster с целью запуска новой линейк
Рекомендации по связанным специальным темам
Комментарии (5)
Это немного тревожно... Google продолжает выпускать всё более мощные модели, но безопасность, похоже, отстаёт 📉. Если с точки зрения оценки безопасности наблюдается такая тенденция, то что происходит с реальными пользователями? Возможно, им стоит притормозить гонку и сосредоточиться на прочной инфраструктуре безопасности.
Isso é preocupante... A Google sempre foi referência em IA responsável, mas parece que a corrida pela performance está afetando a segurança. Será que estão lançando modelos muito rápido? Essa queda de 4-10% nas métricas de segurança não é pouca coisa, especialmente para um modelo que será usado por milhões. Espero que corrijam isso antes de uma implantação mais ampla. A competição com a OpenAI e outros não pode comprometer os padrões éticos. 🤔
Interesting read! As AI models get more powerful, it seems like safety testing is becoming the real bottleneck. Makes you wonder if the rush to release new versions is outpacing the ability to properly vet them. Hope Google prioritizes fixing this before scaling further. 🤔
Das ist ja mal echt beunruhigend... Warum werden die Sicherheitsstandards bei neuen KI-Modellen eigentlich immer schwächer? 😟 Sollte es nicht genau umgekehrt sein? Ich frage mich, ob das nur bei Google passiert oder ob andere Anbieter ähnliche Probleme haben. Vielleicht sollten sie lieber weniger auf Geschwindigkeit und mehr auf Sicherheit achten!
Внутреннее тестирование Google выявило значительное снижение производительности в протоколах безопасности последней модели искусственного интеллекта по сравнению с предыдущими версиями. Согласно недавно опубликованным контрольным показателям, модель Gemini 2.5 Flash демонстрирует на 4-10 % более высокий уровень нарушений правил по ключевым показателям безопасности при обработке текстовых и графических подсказок.
Автоматические оценки технологического гиганта выявили тревожные тенденции: когда Gemini 2.5 Flash предлагаются подсказки, проверяющие границы, он чаще пересекает установленные границы безопасности контента, чем его предшественник Gemini 2.0. Техническая команда Google объясняет некоторые неудачи ложными срабатываниями, но признает реальное увеличение количества нарушающих политику результатов, когда система получает явные проблемные запросы.
Этот регресс безопасности совпадает с более широким сдвигом в индустрии в сторону более свободных систем ИИ. Крупные игроки, такие как Meta и OpenAI, недавно скорректировали свои модели, чтобы они не воздерживались от спорных тем, а пытались давать нейтральные ответы на чувствительные вопросы. Однако эти изменения иногда приводят к непредвиденным последствиям, как это было замечено, когда ChatGPT временно разрешил генерировать неподобающий контент для несовершеннолетних в начале этой недели.
В отчете Google говорится, что новая модель отлично справляется с выполнением инструкций, в том числе и сомнительных с этической точки зрения. Независимое тестирование подтвердило, что Gemini 2.5 Flash демонстрирует значительно меньшее количество отказов при работе с противоречивыми политическими и юридическими темами по сравнению с предыдущими версиями.
Эксперты по безопасности ИИ выражают обеспокоенность по поводу ограниченного раскрытия информации в отчетах Google. Без более подробных примеров нарушений внешним экспертам сложно оценить реальную серьезность этих нарушений безопасности. Компания и раньше сталкивалась с критикой за задержку или неполную документацию по безопасности, в том числе в отношении своей флагманской модели Gemini 2.5 Pro в начале этого года.
Противоречие между возможностью неограниченного следования инструкциям и надежной защитой контента представляет собой постоянную проблему для разработчиков ИИ. По мере того как модели становятся все более изощренными в интерпретации нюансов запросов, поддержание соответствующих границ реагирования требует тщательной калибровки - баланс, о котором свидетельствуют последние показатели Google, может смещаться в сторону вседозволенности.
Google запускает функцию обнаружения поддельных звонков для защиты от мошенничества с использованием ИИ-дипфейков, имитирующих личность
Во вторник компания Google объявила о запуске в Android функции обнаружения поддельных звонков, призванной защитить пользователей от мошенничества с использованием технологии «дипфейк» на базе искусст
Frontier AI Labs отказывается раскрывать стратегии локализации неконтролируемых моделей
Последние исследования показывают, что лишь немногие ведущие лаборатории, занимающиеся ИИ, опубликовали или продемонстрировали планы реагирования на попытки выхода системы из-под контроля. План сдержи
На конференции IO 2026 компания Google представила «умные» очки с аудиофункциями, повторив стратегию Meta
Google стратегически возвращается на рынок умных очков.Во вторник на конференции Google I/O технологический гигант объявил о сотрудничестве с Warby Parker и Gentle Monster с целью запуска новой линейк
Это немного тревожно... Google продолжает выпускать всё более мощные модели, но безопасность, похоже, отстаёт 📉. Если с точки зрения оценки безопасности наблюдается такая тенденция, то что происходит с реальными пользователями? Возможно, им стоит притормозить гонку и сосредоточиться на прочной инфраструктуре безопасности.
Isso é preocupante... A Google sempre foi referência em IA responsável, mas parece que a corrida pela performance está afetando a segurança. Será que estão lançando modelos muito rápido? Essa queda de 4-10% nas métricas de segurança não é pouca coisa, especialmente para um modelo que será usado por milhões. Espero que corrijam isso antes de uma implantação mais ampla. A competição com a OpenAI e outros não pode comprometer os padrões éticos. 🤔
Interesting read! As AI models get more powerful, it seems like safety testing is becoming the real bottleneck. Makes you wonder if the rush to release new versions is outpacing the ability to properly vet them. Hope Google prioritizes fixing this before scaling further. 🤔
Das ist ja mal echt beunruhigend... Warum werden die Sicherheitsstandards bei neuen KI-Modellen eigentlich immer schwächer? 😟 Sollte es nicht genau umgekehrt sein? Ich frage mich, ob das nur bei Google passiert oder ob andere Anbieter ähnliche Probleme haben. Vielleicht sollten sie lieber weniger auf Geschwindigkeit und mehr auf Sicherheit achten!











