option
Maison
Flash info
Contenu
JamesLopez
JamesLopez
7 juillet 2026

La communauté openJiuwen a mis en ligne Skill-Omni, le premier paradigme de compétences multimodales validé par des experts du secteur. Il permet d’élever les agents IA, qui ne fonctionnaient jusqu’alors qu’avec du texte, au niveau de la perception visuelle, ce qui leur donne la capacité d’exécuter avec précision des tâches telles que l’édition photo ou les opérations sur interfaces graphiques, en convertissant des captures d’écran, des états d’interface et des séquences vidéo en ressources visuelles réutilisables. Des outils de génération automatique intégrés permettent de créer des compétences multimodales à partir de contenus en ligne, tandis qu’un mécanisme de lecture sur demande ne charge les éléments visuels que lorsque c’est nécessaire. Cet événement marque un tournant vers une ingénierie d’expérience pour agents basée sur des données multimodales plutôt que sur des documents seuls, et cette fonctionnalité est désormais disponible dans JiuwenSwarm.

commentaires (0)
0/300
OR