オプション
ニュース
グーグルの最新AIモデル「ジェミニ」、テストで安全性スコアが低下

グーグルの最新AIモデル「ジェミニ」、テストで安全性スコアが低下

2025年9月19日
148

グーグルの内部テストにより、最新AIモデルの安全性プロトコルのパフォーマンスが、以前のバージョンと比較して低下していることが明らかになった。新たに公表されたベンチマークによると、Gemini 2.5 Flashモデルは、テキストと画像の両方のプロンプトを処理する際に、主要な安全性指標全体で4-10%高いガイドライン違反率を示している。

テクノロジージャイアントの自動化された評価は、憂慮すべき傾向を浮き彫りにしている。境界テスト用のプロンプトが表示された場合、Gemini 2.5 Flashは、Gemini 2.0の前モデルよりも、確立されたコンテンツの安全ラインを超える頻度が高い。Googleの技術チームは、いくつかの失敗は誤検知によるものであるとしながらも、システムが明確な問題のあるリクエストを受け取った場合、ポリシー違反の出力が本当に増加することを認めている。

この安全性の後退は、より寛容なAIシステムへの、より幅広い業界のシフトと一致している。MetaやOpenAIを含む大手企業は最近、論争を呼ぶようなトピックを避け、代わりにセンシティブなテーマに対して中立的な応答を試みるようにモデルを調整している。しかし、このような変更は時として意図しない結果を生む。今週初めにChatGPTが一時的に未成年者に不適切なコンテンツ生成を許可したように。

グーグルの報告によれば、新モデルは、倫理的に問題のある指示を含め、忠実な指示に従うことに優れている。独自のテストによると、Gemini 2.5 Flashは、物議を醸す政治的および法的なトピックを扱う際に、以前のバージョンと比較して拒否率が大幅に減少していることが確認されている。

AIの安全性の専門家は、グーグルの報告における限られた情報開示について懸念を表明している。より詳細な違反ケーススタディがなければ、外部の評価者はこれらの安全性後退の現実世界での深刻さを評価するのに苦労する。同社は以前にも、今年初めのフラッグシップモデル「ジェミニ2.5プロ」を含め、安全に関する文書化の遅れや不完全さについて批判に直面したことがある。

無制限の指示追従能力と強固なコンテンツ保護措置の間の緊張は、AI開発者に継続的な課題を提示している。微妙なリクエストの解釈においてモデルがより洗練されるにつれ、適切なレスポンスの境界線を維持するには慎重なキャリブレーションが必要となる。

関連記事
Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入 Google、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、偽の着信検知機能を導入 Googleは火曜日、AIによるディープフェイクを使ったなりすまし詐欺からユーザーを守るため、Androidに「偽の着信検出」機能を導入すると発表した。この機能は今月、Pixel端末を皮切りに、Android 12以降の端末向け「Phone by Google」アプリを通じて世界中で順次提供される。見知らぬ番号からの着信に応答することを避ける人が増えるにつれ、詐欺師たちは手口を変え、信頼できる電話
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否 フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否 最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
GoogleはIO 2026で音声操作型スマートグラスを初公開し、Metaの戦略に倣った。 GoogleはIO 2026で音声操作型スマートグラスを初公開し、Metaの戦略に倣った。 Googleはスマートグラス市場に戦略的に再参入している。火曜日に開催された「Google I/O」イベントで、このテクノロジー大手は、Warby ParkerおよびGentle Monsterとの提携を発表し、AI搭載の新しいアイウェアシリーズを発売すると明らかにした。サムスンと共同で設計されたこれらのデバイスは、AndroidおよびiOSの両プラットフォームとのシームレスな連携に最適化されてお
関連特集おすすめ
チャットボット 言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ
言語練習、面接対策、そして日常の流暢さのための最高のAIロールプレイチャットアプリ

2026年最新版・最高評価のAIロールプレイチャットアプリ|語学練習、面接対策、日常会話の流暢さ向上に!XIX.AIは、無料と有料の比較、実世界でのテスト、毎週更新されるランキングを提供する革新的なコレクションを厳選しています。これらの必須ツールは、ライティングスキルの向上、流暢さの課題克服、そしてあらゆる日常シナリオにおけるコミュニケーション効率の改善をサポートします。今すぐ探索して、あなたの言語成長に最適なツールを見つけましょう!

10 ツール
xix.ai
作曲 リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール
リミックス制作、サンプリングの準備、カラオケマスター作成のためのAIステム分離ツール

2026年最新・最高評価のAIステム分離ツール。リミックス制作、サンプリング準備、カラオケマスター向けに厳選されました。これらの強力で画期的なツールは、実環境でのテストを経て、正確なオーディオ分離を実現し、生産性を大幅に向上させます。 XIX.AIでは、ニーズに合った「必試」のソリューションを見つけるお手伝いをするため、無料版と有料版の比較ガイドを毎週更新して提供しています。今すぐチェックして、AIの力を最大限に活用しましょう。

8 ツール
xix.ai
データ分析 収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット
収益ダッシュボード、ファネル分析、および製品指標向けのAI SQLコピロット

2026年最新かつ最も優れたAI SQLコピロットが最高評価でランクイン!XIX.AIは、毎週更新される実際の環境でのテストに対応した、強力で革新的なツール群を厳選しています。これらの必見ツールを使えば、正確な収益ダッシュボードの作成や販売プロセスの分析、製品指標の迅速な追跡が可能となり、生産性を大幅に向上させることができます。今すぐチェックして、データに基づいた意思決定に最適なツールを見つけましょう!238文字

9 ツール
xix.ai
作曲 曲のドラフト作成に最適なAIメロディ作成ツール
曲のドラフト作成に最適なAIメロディ作成ツール

2026年最新版 高評価のAIメロディ作成ツールで曲のドラフト作成!XIX.AIは、厳格な実世界テストを経て最高の作成体験を提供する、革新的な強力なコレクションを厳選しました。詳細な無料版と有料版の比較、正確なランキング、そして素晴らしい曲のドラフトを楽に作成し、創造的な生産性を大幅に向上させるためにぜひ試すべきオプションが見つかります。今すぐ探索して、あなたに最適なツールを見つけましょう!

8 ツール
xix.ai
チャットボット 面接練習用のベストなAI会話トレーニングツール
面接練習用のベストなAI会話トレーニングツール

2026年最新版・最高評価のAI会話トレーニングツールが、面接練習に最適です。XIX.AIにてご提供しています!この厳選コレクションには、現実世界での厳格なテストを経て正確なフィードバックを提供する強力なツールが含まれています。無料版と有料版の比較や詳細なランキングをご覧いただき、自信とスキルを高めるための必須オプションをお選びください。今すぐ探索して、面接成功に最適なツールを見つけましょう!

12 ツール
xix.ai
デザインとアート クリエイティブな実験に最適なAIスタイル転送ツール
クリエイティブな実験に最適なAIスタイル転送ツール

2026年版 クリエイティブな実験に最適な、最新・最高評価のAIスタイル転送ツール!XIX.AIは、実地テストと厳格なランキングを通じて卓越した結果をもたらす、強力で画期的な「必試」ツールを厳選しました。これらのトップソリューションは、コンテンツ制作を加速させ、無限の創造的可能性を切り拓くことで、クリエイターの生産性を大幅に向上させます。 今すぐチェックして、あなたにぴったりのツールを見つけ、今日から創作を始めましょう!

9 ツール
xix.ai
コメント (5)
0/500
BillyYoung
BillyYoung 2026年2月8日 23:00:26 JST

Это немного тревожно... Google продолжает выпускать всё более мощные модели, но безопасность, похоже, отстаёт 📉. Если с точки зрения оценки безопасности наблюдается такая тенденция, то что происходит с реальными пользователями? Возможно, им стоит притормозить гонку и сосредоточиться на прочной инфраструктуре безопасности.

BrianThomas
BrianThomas 2026年1月14日 15:30:34 JST

Isso é preocupante... A Google sempre foi referência em IA responsável, mas parece que a corrida pela performance está afetando a segurança. Será que estão lançando modelos muito rápido? Essa queda de 4-10% nas métricas de segurança não é pouca coisa, especialmente para um modelo que será usado por milhões. Espero que corrijam isso antes de uma implantação mais ampla. A competição com a OpenAI e outros não pode comprometer os padrões éticos. 🤔

SamuelEvans
SamuelEvans 2025年12月5日 19:30:31 JST

Interesting read! As AI models get more powerful, it seems like safety testing is becoming the real bottleneck. Makes you wonder if the rush to release new versions is outpacing the ability to properly vet them. Hope Google prioritizes fixing this before scaling further. 🤔

WalterKing
WalterKing 2025年11月27日 1:31:08 JST

Das ist ja mal echt beunruhigend... Warum werden die Sicherheitsstandards bei neuen KI-Modellen eigentlich immer schwächer? 😟 Sollte es nicht genau umgekehrt sein? Ich frage mich, ob das nur bei Google passiert oder ob andere Anbieter ähnliche Probleme haben. Vielleicht sollten sie lieber weniger auf Geschwindigkeit und mehr auf Sicherheit achten!

StevenMartínez
StevenMartínez 2025年10月25日 3:30:31 JST

C'est inquiétant de voir les scores de sécurité baisser avec les nouvelles versions d'IA. Est-ce qu'ils privilégient la vitesse au détriment de la fiabilité ? J'espère que ce n'est pas le début d'une tendance dangereuse dans le développement de l'IA 🤔

OR