OpenAI、数学およびAI諮問グループを設立;謎のモデルが24日間で100の世界的な問題を解決

9月22日、OpenAIは「数学と人工知能に関する諮問グループ」の設立を発表した。プリンストンの高等研究所を本部とするこの独立した機関は、OpenAIとは別に活動する9人の数学者で構成されている。
さらに注目すべきは、8月28日から学習を開始した謎のモデルが、論争の的となっているナビエ-ストークス千年賞問題を含む、さまざまな数学分野における100以上の長年の未解決問題の解決に成功したとOpenAIが明らかにした点である。
数学者たちは急速な進歩に驚愕し、学術的な開示に関する内部議論が巻き起こっている
OpenAIは、このモデルの数学的な進歩が社内チームを驚かせ、より広い学術コミュニティへの情報提供の最も適切な方法について議論を引き起こしたと指摘した。
数学を基礎科学と認識するOpenAIは、AIによる発見が広範な応用を持つ可能性を認め、これらの能力の開発と導入には慎重なアプローチを採用している。現在、より広範な実装戦略を探っている。
これは、テレンス・タオ、ユ・デン、ピーター・ショルツら著名な数学者による公開書簡に続くもので、彼らは新しいAIシステムのベンチマークとして未解決の数学問題の解決を使用することへの懸念を表明した。OpenAIは、これらの見解が数学コミュニティとのより綿密な関わり合いの必要性を浮き彫りにしていると述べた。
諮問グループにはフィールズ賞受賞者3人が含まれ、OpenAIからの報酬なしで運営される
OpenAIは、この諮問グループが独立して機能し、自発的な助言を行う権利、OpenAIの数学への影響について公にコメントする権利、およびメンバーシップを独立して調整する権利を保持していると明確にした。メンバーは無報酬であるが、このグループはOpenAIの社内数学研究のペースに影響を与えない。
創設メンバーには、フランソワ・シャル(École Normale Supérieure、ENS-PSL)、カミッロ・デ・レリス(高等研究所、グラン・サーソ科学研究所)、ティモシー・ゴワーズ(フランス学院、ケンブリッジ大学)、マーティン・ハイアー(ローザンヌ連邦工科大学、インペリアル・カレッジ・ロンドン)、ニキル・スリヴァスタワ(バークレー、サイモンズ研究所)、ウルリケ・ティルマン(オックスフォード大学、INI)、ラヴィ・ヴァーカル(スタンフォード大学)、エドワード・ウィッテン(IAS)、メラーニー・マッチェット・ウッド(ハーバード大学)が含まれる。そのうち、ゴワーズ、ハイアー、ウィッテンはフィールズ賞受賞者であり、カミッロ・デ・レリスは前述の公開書簡の署名者の一人でもある。
諮問グループは、新たな結果のレビューと普及について助言し、OpenAIが研究成果の重要性を評価するのを支援し、数学研究における学術基準に関する意見を提示する。さらに、OpenAIのツールがどのように数学研究と教育をよりよく支援できるかについての推奨も行う。
関連記事
Anthropic、ユーザーがアクセスを失った後、Claudeアカウントがハッキングされたことを確認
複数のClaudeユーザーが、アクティブな利用がないにもかかわらず、アカウントのクォータが急速に枯渇していることをソーシャルメディアで最近報告しています。Anthropicの調査により、ハッカーが悪性ソフトウェアを通じてログインセッションを窃取し、ユーザーアカウントに不正アクセスした上で、被害者の貴重な呼び出しクォータを悪用していたことが明らかになりました。この侵害は、イギリス東サセックス在住の独立系AIコンサルタントであるグラント・ダーシー氏によって、8月4日に最初に発見されました。彼は積極
Senspeech X2.5 Twin Stars:エッジにおける初の百万トークンコンテキスト、国内の計算資源で完全にトレーニング済み
9月1日、iFLYTEKの完全子会社であるCiyuan Xinghuoは、2つのエッジ側向け汎用大規模モデル「Xinghuo X2.5-4B」と「Xinghuo X2.5-1.7B」を正式にリリースし、オープンソース化しました。これらのモデルは、最大100万トークンのコンテキスト長をネイティブにサポートする初のモデルであり、モデル重み、コードリポジトリ、デプロイメントドキュメントへの完全なアクセスを提供します。100万レベルのコンテキストサポート、小規模モデルでも「書籍全体を読める」両モデルはハ
Meitun LongCat、LoHoSearchをリリース、BrowseCompのスコアが30%を下回る
過去1年間、検索エージェントの能力は主にBrowseCompによって定義されてきました。しかし、このベンチマークはその関連性を失いつつあります——わずか10ヶ月でモデルの性能を30%から90%へと引き上げましたが、その価値は急速に低下しています。7月17日、MeituanのLongCatは、検索エージェント開発における意味のある進捗を再点火するために設計された、より厳格な評価であるLoHoSearchを発表しました。LoHoSearchの課題は手動で作成されたものではなく、762万のエンティティ
関連特集おすすめ
コメント (0)
0/500

9月22日、OpenAIは「数学と人工知能に関する諮問グループ」の設立を発表した。プリンストンの高等研究所を本部とするこの独立した機関は、OpenAIとは別に活動する9人の数学者で構成されている。
さらに注目すべきは、8月28日から学習を開始した謎のモデルが、論争の的となっているナビエ-ストークス千年賞問題を含む、さまざまな数学分野における100以上の長年の未解決問題の解決に成功したとOpenAIが明らかにした点である。
数学者たちは急速な進歩に驚愕し、学術的な開示に関する内部議論が巻き起こっている
OpenAIは、このモデルの数学的な進歩が社内チームを驚かせ、より広い学術コミュニティへの情報提供の最も適切な方法について議論を引き起こしたと指摘した。
数学を基礎科学と認識するOpenAIは、AIによる発見が広範な応用を持つ可能性を認め、これらの能力の開発と導入には慎重なアプローチを採用している。現在、より広範な実装戦略を探っている。
これは、テレンス・タオ、ユ・デン、ピーター・ショルツら著名な数学者による公開書簡に続くもので、彼らは新しいAIシステムのベンチマークとして未解決の数学問題の解決を使用することへの懸念を表明した。OpenAIは、これらの見解が数学コミュニティとのより綿密な関わり合いの必要性を浮き彫りにしていると述べた。
諮問グループにはフィールズ賞受賞者3人が含まれ、OpenAIからの報酬なしで運営される
OpenAIは、この諮問グループが独立して機能し、自発的な助言を行う権利、OpenAIの数学への影響について公にコメントする権利、およびメンバーシップを独立して調整する権利を保持していると明確にした。メンバーは無報酬であるが、このグループはOpenAIの社内数学研究のペースに影響を与えない。
創設メンバーには、フランソワ・シャル(École Normale Supérieure、ENS-PSL)、カミッロ・デ・レリス(高等研究所、グラン・サーソ科学研究所)、ティモシー・ゴワーズ(フランス学院、ケンブリッジ大学)、マーティン・ハイアー(ローザンヌ連邦工科大学、インペリアル・カレッジ・ロンドン)、ニキル・スリヴァスタワ(バークレー、サイモンズ研究所)、ウルリケ・ティルマン(オックスフォード大学、INI)、ラヴィ・ヴァーカル(スタンフォード大学)、エドワード・ウィッテン(IAS)、メラーニー・マッチェット・ウッド(ハーバード大学)が含まれる。そのうち、ゴワーズ、ハイアー、ウィッテンはフィールズ賞受賞者であり、カミッロ・デ・レリスは前述の公開書簡の署名者の一人でもある。
諮問グループは、新たな結果のレビューと普及について助言し、OpenAIが研究成果の重要性を評価するのを支援し、数学研究における学術基準に関する意見を提示する。さらに、OpenAIのツールがどのように数学研究と教育をよりよく支援できるかについての推奨も行う。
Anthropic、ユーザーがアクセスを失った後、Claudeアカウントがハッキングされたことを確認
複数のClaudeユーザーが、アクティブな利用がないにもかかわらず、アカウントのクォータが急速に枯渇していることをソーシャルメディアで最近報告しています。Anthropicの調査により、ハッカーが悪性ソフトウェアを通じてログインセッションを窃取し、ユーザーアカウントに不正アクセスした上で、被害者の貴重な呼び出しクォータを悪用していたことが明らかになりました。この侵害は、イギリス東サセックス在住の独立系AIコンサルタントであるグラント・ダーシー氏によって、8月4日に最初に発見されました。彼は積極
Senspeech X2.5 Twin Stars:エッジにおける初の百万トークンコンテキスト、国内の計算資源で完全にトレーニング済み
9月1日、iFLYTEKの完全子会社であるCiyuan Xinghuoは、2つのエッジ側向け汎用大規模モデル「Xinghuo X2.5-4B」と「Xinghuo X2.5-1.7B」を正式にリリースし、オープンソース化しました。これらのモデルは、最大100万トークンのコンテキスト長をネイティブにサポートする初のモデルであり、モデル重み、コードリポジトリ、デプロイメントドキュメントへの完全なアクセスを提供します。100万レベルのコンテキストサポート、小規模モデルでも「書籍全体を読める」両モデルはハ
Meitun LongCat、LoHoSearchをリリース、BrowseCompのスコアが30%を下回る
過去1年間、検索エージェントの能力は主にBrowseCompによって定義されてきました。しかし、このベンチマークはその関連性を失いつつあります——わずか10ヶ月でモデルの性能を30%から90%へと引き上げましたが、その価値は急速に低下しています。7月17日、MeituanのLongCatは、検索エージェント開発における意味のある進捗を再点火するために設計された、より厳格な評価であるLoHoSearchを発表しました。LoHoSearchの課題は手動で作成されたものではなく、762万のエンティティ





家






