オプション
速報
コンテンツ
AnthonyPerez
AnthonyPerez
2026年4月16日

Google DeepMindは、AIビジョンモデルの主要な弱点である「全体的な画像理解力は高いにもかかわらず、細部の位置特定が不十分である」という課題に対処するため、TIPSv2を発表しました。この新しい手法は、全領域監督学習によりゼロショットセグメンテーションの精度を141ポイント向上させ、学習パラメータを42削減し、多階層のテキスト記述を採用しています。このモデルはセグメンテーションにおいて新たなベンチマークを樹立し、検索および分類においてもより大規模なモデルを上回る性能を発揮します。コードと重みデータはオープンソース化されています。

Google DeepMindは、AIビジョンモデルの主要な弱点である「全体的な画像理解力は高いにもかかわらず、細部の位置特定が不十分である」という課題に対処するため、TIPSv2を発表しました。この新しい手法は、全領域監督学習によりゼロショットセグメンテーションの精度を141ポイント向上させ、学習パラメータを42削減し、多階層のテキスト記述を採用しています。このモデルはセグメンテーションにおいて新たなベンチマークを樹立し、検索および分類においてもより大規模なモデルを上回る性能を発揮します。コードと重みデータはオープンソース化されています。
コメント (0)
0/300
OR