オプション
速報
コンテンツ
JamesLopez
JamesLopez
2026年7月7日

openJiuwenコミュニティは、業界で初めてエンジニアリングによる検証を経たマルチモーダルなSkillパラダイムであるSkill-Omniを公開しました。この技術により、AIエージェントはテキストのみの処理から視覚認識機能を備えたものへと進化し、ウェブスクリーンショットやインターフェース状態、動画シーケンスを再利用可能な視覚アセットに変換することで、写真編集やGUI操作といったタスクを正確に実行できるようになります。内蔵された自動生成ツールによってオンラインコンテンツからマルチモーダルなSkillが作成され、またオンデマンド型の読み込みメカニズムによって必要な時だけ視覚的証拠が読み込まれます。これにより、文書中心のエージェント開発からマルチモーダルなエージェント体験の設計へと移行することになり、この機能は現在JiuwenSwarmで利用可能です。

コメント (0)
0/300
OR