opção
JamesLopez
JamesLopez
7 de Julho de 2026

A comunidade openJiuwen lançou o Skill-Omni, o primeiro paradigma de habilidades multimodais validado tecnicamente pelo setor. Ele eleva os agentes de IA de um modelo baseado apenas em texto para um com percepção visual, permitindo a execução precisa de tarefas como edição de fotos e operações em interfaces gráficas por meio da conversão de capturas de tela, estados de interface e sequências de vídeo em ativos visuais reutilizáveis. Ferramentas de geração automática integradas criam habilidades multimodais a partir de conteúdo online, enquanto um mecanismo de leitura sob demanda carrega as evidências visuais somente quando necessário. Isso representa uma mudança na engenharia de experiências para agentes, saindo do modelo baseado em documentos para um foco em recursos multimodais, já disponível no JiuwenSwarm.

Comentários (0)
0/300
OR