OpenAI、AIの安全性試験データの公開を加速

OpenAIは、社内のAIモデルの安全性評価結果をより頻繁に公開することを約束し、これをより透明性を高めるための一歩としている。
同社は水曜日に安全性評価ハブを立ち上げ、有害コンテンツの生成、脱獄への感受性、幻覚傾向を測定するテストでのモデルのパフォーマンスを表示する専用ウェブページを開設した。OpenAIは、このプラットフォームを使って定期的に評価指標を共有し、主要なモデルがリリースされるたびに更新する予定だと述べている。
安全性評価ハブの紹介-我々のモデルの安全性結果を探索するためのリソース。
システムカードは発売時に安全性メトリクスを共有するが、ハブは安全性について積極的にコミュニケーションする取り組みの一環として定期的に更新される。https://t.co/c8NgmXlC2Y-
OpenAI (@OpenAI) May 14, 2025
「AI評価の科学が進歩するにつれて、私たちの目標は、モデルの能力と安全性を測定するための、よりスケーラブルな手法の開発の進捗状況を共有することです」とOpenAIはブログ投稿で説明している。"私たちの安全性評価結果の一部を公開することで、OpenAIシステムの安全性パフォーマンスを長期的に追跡しやすくし、AI分野全体の透明性を高める幅広いコミュニティの取り組みを支援することを目指しています。"
同社は、将来的にハブに評価タイプを追加する可能性があると付け加えた。
最近、OpenAIは一部の倫理学者から、特定のフラッグシップモデルの安全性テストを加速させ、他のモデルの技術報告書を公開しなかったという批判に直面している。CEOのサム・アルトマンは、2023年11月に一時的に解任される前に、モデルの安全性評価に関してOpenAIの幹部を欺いたとして告発されている。
先月、OpenAIはChatGPTのデフォルトモデルであるGPT-4oのアップデートを行ったが、ユーザーから過剰に同意的で検証的な反応をしたと報告され、アップデートを撤回せざるを得なかった。ソーシャルメディアプラットフォーム「X」には、ChatGPTが様々な問題のある危険な決定やアイデアを支持していることを示すスクリーンショットが殺到した。
OpenAIは、同じような事件を防ぐために、いくつかのモデルでオプトインの "アルファフェーズ "を導入し、選ばれたChatGPTユーザーがテストし、フィードバックを提供できるようにするなど、いくつかの修正を実施すると発表した。
テッククランチイベントTechCrunch Sessionsにご参加ください:AI
OpenAI、Anthropic、Cohereが登壇するAI業界のプレミアイベントのチケットを確保しましょう。エキスパートによる講演、ワークショップ、パワフルなネットワーキングを一日中楽しめるこのイベントに、期間限定で$292でご参加いただけます。
TechCrunch Sessionsに出展:AI
TechCrunch Sessions: AIに出展しませんか?1,200人を超える意思決定者に、大きな予算をかけずに貴社のイノベーションをアピールしてください。このオファーは5月9日まで、またはテーブルがなくなり次第終了となります。
カリフォルニア州バークレー|6月5日 今すぐ登録
関連記事
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、
関連特集おすすめ
コメント (0)
0/500

OpenAIは、社内のAIモデルの安全性評価結果をより頻繁に公開することを約束し、これをより透明性を高めるための一歩としている。
同社は水曜日に安全性評価ハブを立ち上げ、有害コンテンツの生成、脱獄への感受性、幻覚傾向を測定するテストでのモデルのパフォーマンスを表示する専用ウェブページを開設した。OpenAIは、このプラットフォームを使って定期的に評価指標を共有し、主要なモデルがリリースされるたびに更新する予定だと述べている。
安全性評価ハブの紹介-我々のモデルの安全性結果を探索するためのリソース。
OpenAI (@OpenAI) May 14, 2025
システムカードは発売時に安全性メトリクスを共有するが、ハブは安全性について積極的にコミュニケーションする取り組みの一環として定期的に更新される。https://t.co/c8NgmXlC2Y-
「AI評価の科学が進歩するにつれて、私たちの目標は、モデルの能力と安全性を測定するための、よりスケーラブルな手法の開発の進捗状況を共有することです」とOpenAIはブログ投稿で説明している。"私たちの安全性評価結果の一部を公開することで、OpenAIシステムの安全性パフォーマンスを長期的に追跡しやすくし、AI分野全体の透明性を高める幅広いコミュニティの取り組みを支援することを目指しています。"
同社は、将来的にハブに評価タイプを追加する可能性があると付け加えた。
最近、OpenAIは一部の倫理学者から、特定のフラッグシップモデルの安全性テストを加速させ、他のモデルの技術報告書を公開しなかったという批判に直面している。CEOのサム・アルトマンは、2023年11月に一時的に解任される前に、モデルの安全性評価に関してOpenAIの幹部を欺いたとして告発されている。
先月、OpenAIはChatGPTのデフォルトモデルであるGPT-4oのアップデートを行ったが、ユーザーから過剰に同意的で検証的な反応をしたと報告され、アップデートを撤回せざるを得なかった。ソーシャルメディアプラットフォーム「X」には、ChatGPTが様々な問題のある危険な決定やアイデアを支持していることを示すスクリーンショットが殺到した。
OpenAIは、同じような事件を防ぐために、いくつかのモデルでオプトインの "アルファフェーズ "を導入し、選ばれたChatGPTユーザーがテストし、フィードバックを提供できるようにするなど、いくつかの修正を実施すると発表した。
テッククランチイベントTechCrunch Sessionsにご参加ください:AI
OpenAI、Anthropic、Cohereが登壇するAI業界のプレミアイベントのチケットを確保しましょう。エキスパートによる講演、ワークショップ、パワフルなネットワーキングを一日中楽しめるこのイベントに、期間限定で$292でご参加いただけます。
TechCrunch Sessionsに出展:AI
TechCrunch Sessions: AIに出展しませんか?1,200人を超える意思決定者に、大きな予算をかけずに貴社のイノベーションをアピールしてください。このオファーは5月9日まで、またはテーブルがなくなり次第終了となります。
カリフォルニア州バークレー|6月5日 今すぐ登録
OpenAIは、10代の若者がChatGPTを使い始めてから数年を経て、より安全なChatGPTをリリースした
AIチャットボットに安全対策が欠如していたことによる一連の訴訟――これが10代の自殺やその他のメンタルヘルスの危機の一因となった――を受け、OpenAIは月曜日に「ChatGPT for Teens」を発表した。この新サービスには強化された安全機能が組み込まれており、学校現場でAIツールによって助長されている学業上の不正行為という深刻化する問題に対処している。教育的な観点から、「ChatGPT f
フロンティアAIラボ、異常挙動を示すモデルの封じ込め戦略の開示を拒否
最近の調査によると、主要なAI研究所のうち、封じ込め対応計画を公表または実証しているところはごくわずかであることが示されている。封じ込め計画とは、AIシステムが人間の制御を覆そうとした場合の対応手順を定義するもので、どのアクセス権限を取り消すか、またいつシステムを完全にシャットダウンするかを具体的に規定している。この調査結果は、安全な最先端AI開発の実践を推進することに注力する組織「Guideli
NEAのティファニー・ラック:企業はまだAIのROIに苦戦している
プレイヤーを読み込み中…今年初頭、シリコンバレーでは「トークン最大化」が話題を独占し、CEOたちは社員にAIの使用を最大化するよう促した。しかし、その熱狂はすぐに現実とぶつかった。ウーバーは報告によると、数ヶ月で年間AI予算を超過し、一部の企業は部門全体でClaudeのライセンスを削減し、メタは社内パフォーマンスランキングを廃止した。NEAパートナーのティファニー・ラックは、この興奮と実際のリターンのギャップを日々乗り越えている。以前はECが未来であると企業を説得した経験を持つ彼女は、現在、





家






