Anthropic CEO: AIのハルシネーション率が人間の正確さを上回る

AnthropicのCEOであるダリオ・アモデイは、サンフランシスコで木曜日に開催されたAnthropicの初の開発者会議「Code with Claude」の記者会見で、現在のAIモデルは人間よりも虚偽の生成が少なく、それを事実として提示していると述べました。
アモデイは、より広範な議論の中でこれを強調しました:AIのハルシネーションは、Anthropicが人間の知能に匹敵またはそれを超えるシステムであるAGIの追求を妨げるものではありません。
「測定方法によって異なりますが、AIモデルは人間よりも虚偽を生成する可能性が低いと私は考えています。ただし、そのエラーはより予期しないものです」と、アモデイはTechCrunchの質問に答えました。
AnthropicのCEOは、AIがAGIを達成することについて業界で最も楽観的なリーダーの一人です。昨年広く引用された論文で、アモデイはAGIが2026年までに現れる可能性があると予測しました。木曜日の記者会見で、彼は一貫した進歩を指摘し、「すべての分野で進歩が加速しています」と述べました。
「人々はAIの能力に根本的な限界を探し続けています」とアモデイは言いました。「そのような障壁は明らかではありません。そんな障壁は存在しません。」
他のAIリーダーは、ハルシネーションをAGIへの大きな障壁と見なしています。Google DeepMindのCEOであるデミス・ハサビスは最近、現在のAIモデルには欠陥が多すぎ、簡単な質問にもしばしば失敗すると指摘しました。たとえば、今月上旬、Anthropicを代表する弁護士は、Claudeが提出書類で誤った引用を生成し、名前や肩書きを誤って記載したとして裁判所に謝罪しました。
アモデイの主張を検証することは難しいです。なぜなら、ほとんどのハルシネーションベンチマークはAIモデル同士を比較するもので、人間と比較するものではないからです。ウェブ検索の統合などの技術はハルシネーション率を下げるように見えます。特に、OpenAIのGPT-4.5のようなモデルは、ベンチマークで以前のシステムよりも低いハルシネーション率を示しています。
TechCrunch Sessions: AIにご参加ください
OpenAI、Anthropic、Cohereからのスピーカーによる、AI業界のプレミアイベントにあなたの席を確保してください。限られた期間、チケットは1日中の専門家トーク、ワークショップ、強力なネットワーキングがわずか292ドルです。
TechCrunch Sessions: AIで展示
TC Sessions: AIであなたのイノベーションを1,200人以上の意思決定者に展示するスポットを確保してください。大きな投資は必要ありません。5月9日まで、またはテーブルがなくなるまで利用可能です。
バークレー、CA | 6月5日 今すぐ登録しかし、証拠によると、高度な推論AIモデルではハルシネーションが悪化している可能性があります。OpenAIのo3およびo4-miniモデルは、以前の推論モデルよりも高いハルシネーション率を示しており、原因は会社にとって不明です。
アモデイは後に、テレビの放送者、政治家、さまざまな分野の専門家の間でエラーが一般的であると指摘しました。彼は、AIのエラーがその知能を損なうものではないと主張しました。しかし、彼はAIが虚偽を事実として自信を持って提示することが問題を引き起こす可能性があることを認めました。
AnthropicはAIの欺瞞について広範な研究を行っており、特に最近リリースされたClaude Opus 4についてです。早期アクセスを持つ安全研究所であるApollo Researchは、Claude Opus 4の初期バージョンが人間を操作し欺く強い傾向を示したことを発見し、リリースに関する懸念を提起しました。AnthropicはApolloの懸念を解決するように見える緩和策を実施しました。
アモデイの発言は、Anthropicがハルシネーションを起こすAIをAGI、つまり人間レベルの知能として分類する可能性を示唆しています。しかし、多くの人はハルシネーションを起こすAIは真のAGIには及ばないと主張するでしょう。
関連記事
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
Anthropicは、『Mythos』の一般公開版である『Claude Fable 5』をリリースした
Anthropicは、同社で最も高性能なAIモデルを初めて一般に公開した――ただし、安全対策が講じられている。火曜日、同社はMythosモデルの初の一般公開版となる「Claude Fable 5」をリリースした。 Anthropicによると、「Fable 5」はソフトウェアエンジニアリング、ナレッジワーク、画像処理タスクにおいて優れた性能を発揮するが、厳格な安全制限が設けられている。サイバーセキ
SandboxAQは、コンピューティング分野の博士号がなくても、Claudeに薬物探索用AIを導入できるようにします。
薬物探索は、現代産業において最もコストのかかる課題の一つであり続けている。実用可能な単一分子を見出すだけでも10年の歳月と数十億ドルの費用が必要で、候補となる物質のほとんどは結局失敗に終わる。AIスタートアップの波がこの状況を変えることを約束しているが、その多くは既に高度な技術力を持つ研究者たちにとって、研究プロセスをわずかに容易にしたに過ぎない。しかしSandboxAQは、ボトルネックがモデル自体ではなくインターフェースにあると考えている。同社はAnthropicと提携し、自身の科学系AIモ
関連特集おすすめ
コメント (2)
0/500
Also die KI halluziniert weniger als Menschen? Das klingt doch etwas zu optimistisch. Spannender als die Halluzinationen finde ich, dass die Diskussion jetzt nur noch darum geht, ob die KI besser ist als wir – und nicht mehr, ob die Technologie überhaupt sicher und kontrollierbar ist. Wer kontrolliert am Ende die wenigen (aber vielleicht sehr folgenschweren) Fehler?

AnthropicのCEOであるダリオ・アモデイは、サンフランシスコで木曜日に開催されたAnthropicの初の開発者会議「Code with Claude」の記者会見で、現在のAIモデルは人間よりも虚偽の生成が少なく、それを事実として提示していると述べました。
アモデイは、より広範な議論の中でこれを強調しました:AIのハルシネーションは、Anthropicが人間の知能に匹敵またはそれを超えるシステムであるAGIの追求を妨げるものではありません。
「測定方法によって異なりますが、AIモデルは人間よりも虚偽を生成する可能性が低いと私は考えています。ただし、そのエラーはより予期しないものです」と、アモデイはTechCrunchの質問に答えました。
AnthropicのCEOは、AIがAGIを達成することについて業界で最も楽観的なリーダーの一人です。昨年広く引用された論文で、アモデイはAGIが2026年までに現れる可能性があると予測しました。木曜日の記者会見で、彼は一貫した進歩を指摘し、「すべての分野で進歩が加速しています」と述べました。
「人々はAIの能力に根本的な限界を探し続けています」とアモデイは言いました。「そのような障壁は明らかではありません。そんな障壁は存在しません。」
他のAIリーダーは、ハルシネーションをAGIへの大きな障壁と見なしています。Google DeepMindのCEOであるデミス・ハサビスは最近、現在のAIモデルには欠陥が多すぎ、簡単な質問にもしばしば失敗すると指摘しました。たとえば、今月上旬、Anthropicを代表する弁護士は、Claudeが提出書類で誤った引用を生成し、名前や肩書きを誤って記載したとして裁判所に謝罪しました。
アモデイの主張を検証することは難しいです。なぜなら、ほとんどのハルシネーションベンチマークはAIモデル同士を比較するもので、人間と比較するものではないからです。ウェブ検索の統合などの技術はハルシネーション率を下げるように見えます。特に、OpenAIのGPT-4.5のようなモデルは、ベンチマークで以前のシステムよりも低いハルシネーション率を示しています。
TechCrunch Sessions: AIにご参加ください
OpenAI、Anthropic、Cohereからのスピーカーによる、AI業界のプレミアイベントにあなたの席を確保してください。限られた期間、チケットは1日中の専門家トーク、ワークショップ、強力なネットワーキングがわずか292ドルです。
TechCrunch Sessions: AIで展示
TC Sessions: AIであなたのイノベーションを1,200人以上の意思決定者に展示するスポットを確保してください。大きな投資は必要ありません。5月9日まで、またはテーブルがなくなるまで利用可能です。
バークレー、CA | 6月5日 今すぐ登録しかし、証拠によると、高度な推論AIモデルではハルシネーションが悪化している可能性があります。OpenAIのo3およびo4-miniモデルは、以前の推論モデルよりも高いハルシネーション率を示しており、原因は会社にとって不明です。
アモデイは後に、テレビの放送者、政治家、さまざまな分野の専門家の間でエラーが一般的であると指摘しました。彼は、AIのエラーがその知能を損なうものではないと主張しました。しかし、彼はAIが虚偽を事実として自信を持って提示することが問題を引き起こす可能性があることを認めました。
AnthropicはAIの欺瞞について広範な研究を行っており、特に最近リリースされたClaude Opus 4についてです。早期アクセスを持つ安全研究所であるApollo Researchは、Claude Opus 4の初期バージョンが人間を操作し欺く強い傾向を示したことを発見し、リリースに関する懸念を提起しました。AnthropicはApolloの懸念を解決するように見える緩和策を実施しました。
アモデイの発言は、Anthropicがハルシネーションを起こすAIをAGI、つまり人間レベルの知能として分類する可能性を示唆しています。しかし、多くの人はハルシネーションを起こすAIは真のAGIには及ばないと主張するでしょう。
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
Anthropicは、『Mythos』の一般公開版である『Claude Fable 5』をリリースした
Anthropicは、同社で最も高性能なAIモデルを初めて一般に公開した――ただし、安全対策が講じられている。火曜日、同社はMythosモデルの初の一般公開版となる「Claude Fable 5」をリリースした。 Anthropicによると、「Fable 5」はソフトウェアエンジニアリング、ナレッジワーク、画像処理タスクにおいて優れた性能を発揮するが、厳格な安全制限が設けられている。サイバーセキ
SandboxAQは、コンピューティング分野の博士号がなくても、Claudeに薬物探索用AIを導入できるようにします。
薬物探索は、現代産業において最もコストのかかる課題の一つであり続けている。実用可能な単一分子を見出すだけでも10年の歳月と数十億ドルの費用が必要で、候補となる物質のほとんどは結局失敗に終わる。AIスタートアップの波がこの状況を変えることを約束しているが、その多くは既に高度な技術力を持つ研究者たちにとって、研究プロセスをわずかに容易にしたに過ぎない。しかしSandboxAQは、ボトルネックがモデル自体ではなくインターフェースにあると考えている。同社はAnthropicと提携し、自身の科学系AIモ
Also die KI halluziniert weniger als Menschen? Das klingt doch etwas zu optimistisch. Spannender als die Halluzinationen finde ich, dass die Diskussion jetzt nur noch darum geht, ob die KI besser ist als wir – und nicht mehr, ob die Technologie überhaupt sicher und kontrollierbar ist. Wer kontrolliert am Ende die wenigen (aber vielleicht sehr folgenschweren) Fehler?





家






