Die openJiuwen-Community hat Skill-Omni veröffentlicht – das erste vom Branchenverband validierte, multimodale Skill-Konzept für die Ingenieurwelt. Es erweitert die Fähigkeiten von KI-Agenten von rein textbasierten Ansätzen auf visuelle Wahrnehmung und ermöglicht so die präzise Ausführung von Aufgaben wie Bildbearbeitung oder GUI-Operationen, indem es Web-Screenshots, Interface-Zustände sowie Videosequenzen in wiederverwendbare visuelle Ressourcen umwandelt. Integrierte Automatisierungswerkzeuge erstellen aus Online-Inhalten multimodale Skills, während ein auf Anfrage aktiverlesender Mechanismus nur dann visuelle Belege lädt, wenn sie benötigt werden. Damit markiert dieses Konzept einen Wandel von einer dokumentenbasierten zu einer multimodalen Agentenerfahrungseingebung – verfügbar bereits in JiuwenSwarm.





Heim
