openJiuwen 社羣釋出了 Skill-Omni,這是業內首個經過工程驗證的多模態技能框架。該框架將 AI 智慧體從僅支援文字處理的能力提升至具備視覺感知能力,能夠透過將網頁截圖、介面狀態及影片序列轉換為可重複使用的視覺資源,從而實現照片編輯和 GUI 操作等任務的精準執行。其內建的自動生成工具可從線上內容中建立多模態技能,同時還會採用按需載入機制,僅在必要時才讀取相關視覺資訊。這一舉措標誌著智慧體體驗工程從以文件驅動轉向多模態驅動,目前該功能已在 JiuwenSwarm 中正式上線。
評論 (0)
0/300





首頁
