オプション
家
速報
コンテンツ
RoyLopez
RoyLopez
2026年9月17日

Xiaomi MiMo チームは、新しい大規模モデル MiMo-V2.6 のリアルタイム強化学習の進捗状況を、ライブトレーニングページを通じて公開しました。元 DeepSeek 研究者の羅福立(ルー・フリ)が率いるこのプロジェクトは、大規模なマルチタスクエージェント実験と完全非同期並列処理を特徴としています。2つのバージョンのトレーニングコストは合計で128万ドルを超え、合わせて約30時間かかりました。この透明性の高いアプローチは、ブラックボックス実験からオープンソースエンジニアリングへの転換を示しており、強化学習のスケーリング法則および人工汎用知能(AGI)探索における Xiaomi の進歩を強調しています。

コメント (0)
0/300
OR