Meta增強AI安全以先進Llama工具
Meta已發布全新Llama安全工具,以強化AI開發並防範新興威脅。
這些升級的Llama AI模型安全工具與Meta的新資源搭配,旨在賦能網路安全團隊利用AI進行防禦,提升所有AI利益相關者的安全性。
使用Llama模型的開發者現可直接在Meta的Llama Protections頁面、Hugging Face及GitHub上獲得增強工具。
Llama Guard 4引入多模態功能,支持文字與圖像的安全執行,這對於日益視覺化的AI應用至關重要。它已整合至Meta的新Llama API,目前處於有限預覽階段。
LlamaFirewall作為新成員,成為AI系統的安全中心,協調安全模型並與Meta的保護工具整合,以對抗提示注入攻擊、不安全程式碼生成或惡意AI外掛行為等風險。
Meta還優化了Llama Prompt Guard。更新後的Prompt Guard 2 (86M)模型擅長檢測越獄嘗試與提示注入。此外,精簡的Prompt Guard 2 22M將延遲與運算成本降低高達75%,為注重成本的開發者維持強大檢測能力。
除了開發者,Meta還為網路安全專業人士提供AI驅動工具,以對抗網路攻擊,滿足對先進防禦日益增長的需求。
CyberSec Eval 4基準套件已全面改進,為組織提供評估AI在安全任務中表現的工具。它包含兩個新功能:
- CyberSOC Eval:與CrowdStrike合作開發,此框架評估AI在真實安全運營中心環境中的有效性,聚焦於威脅檢測與應對。它即將推出。
- AutoPatchBench:測試Llama及其他AI模型在漏洞利用前識別並修補程式碼漏洞的能力。
Meta的Llama Defenders計畫為合作夥伴與開發者提供客製化的AI安全解決方案,結合開源與早期存取工具,應對多樣化挑戰。
Meta分享其內部自動化敏感文件分類工具,該工具標記敏感文件,以防止在AI系統(如RAG設置)中發生未授權洩露或誤用。
為對抗AI生成音頻詐騙,Meta與ZenDesk、Bell Canada及AT&T等合作夥伴分享Llama生成音頻檢測器與Llama音頻水印檢測器,以識別釣魚或詐騙中的欺詐AI語音。
Meta還預覽了WhatsApp的私有處理功能,使AI能在不存取訊息內容的情況下摘要訊息或起草回覆,優先保障用戶隱私。
Meta公開其威脅模型,鼓勵安全研究人員在發布前審查架構,展現對強大隱私措施的承諾。
Meta這一系列全面的AI安全更新,強化了其AI生態系統,同時為科技社群提供安全開發與有效防禦的工具。
另見:Microsoft揭露40億美元的AI驅動詐騙企圖
在阿姆斯特丹、加州及倫敦的AI與大數據博覽會上探索更多關於AI與大數據的資訊,該活動與智能自動化會議、BlockX、數位轉型週及網路安全與雲端博覽會同期舉辦。
在此探索TechForge即將舉辦的企業技術活動與網路研討會。
相關文章
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
亞馬遜推出“Alexa for Shopping”,同時將Rufus邊緣化
亞馬遜推出了“Alexa for Shopping”,將 Rufus 購物聊天機器人 Alexa+ 整合到應用程式、網站和 Echo Show 裝置中。該助手回答產品查詢、比較商品、跟蹤價格,並支援購物提醒。它還處理計劃中的購物操作和符合條件的自動購買。據該公司稱,“Alexa for Shopping”將 Rufus 的產品專業知識與 Alexa+ 的個性化助手上下文相結合。亞馬遜表示,Rufus 在 2025 年協助了超過 3 億客戶進行產品研究、比較和購買。GeekWire 報道稱,
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
相關專題推薦
評論 (2)
0/500
Ces outils semblent prometteurs, mais j'espère que les gros acteurs comme Meta vont vraiment s'intéresser à la sécurité dès la conception, pas seulement en réaction aux problèmes. La course à l'IA crée un terrain dangereux si la robustesse est sacrifiée pour la vitesse de déploiement. 🤔 On verra à l'usage.
A Meta está realmente investindo pesado em segurança de IA! Essas novas ferramentas do Llama parecem promissoras para desenvolvedores. Espero que essas atualizações ajudem a prevenir vazamentos de dados e viés algorítmico, problemas que têm sido frequentes. Será que outras grandes empresas, como Google e OpenAI, vão seguir o exemplo e lançar recursos semelhantes? 🤔 É uma corrida interessante para ver quem protege melhor os usuários.
Meta已發布全新Llama安全工具,以強化AI開發並防範新興威脅。
這些升級的Llama AI模型安全工具與Meta的新資源搭配,旨在賦能網路安全團隊利用AI進行防禦,提升所有AI利益相關者的安全性。
使用Llama模型的開發者現可直接在Meta的Llama Protections頁面、Hugging Face及GitHub上獲得增強工具。
Llama Guard 4引入多模態功能,支持文字與圖像的安全執行,這對於日益視覺化的AI應用至關重要。它已整合至Meta的新Llama API,目前處於有限預覽階段。
LlamaFirewall作為新成員,成為AI系統的安全中心,協調安全模型並與Meta的保護工具整合,以對抗提示注入攻擊、不安全程式碼生成或惡意AI外掛行為等風險。
Meta還優化了Llama Prompt Guard。更新後的Prompt Guard 2 (86M)模型擅長檢測越獄嘗試與提示注入。此外,精簡的Prompt Guard 2 22M將延遲與運算成本降低高達75%,為注重成本的開發者維持強大檢測能力。
除了開發者,Meta還為網路安全專業人士提供AI驅動工具,以對抗網路攻擊,滿足對先進防禦日益增長的需求。
CyberSec Eval 4基準套件已全面改進,為組織提供評估AI在安全任務中表現的工具。它包含兩個新功能:
- CyberSOC Eval:與CrowdStrike合作開發,此框架評估AI在真實安全運營中心環境中的有效性,聚焦於威脅檢測與應對。它即將推出。
- AutoPatchBench:測試Llama及其他AI模型在漏洞利用前識別並修補程式碼漏洞的能力。
Meta的Llama Defenders計畫為合作夥伴與開發者提供客製化的AI安全解決方案,結合開源與早期存取工具,應對多樣化挑戰。
Meta分享其內部自動化敏感文件分類工具,該工具標記敏感文件,以防止在AI系統(如RAG設置)中發生未授權洩露或誤用。
為對抗AI生成音頻詐騙,Meta與ZenDesk、Bell Canada及AT&T等合作夥伴分享Llama生成音頻檢測器與Llama音頻水印檢測器,以識別釣魚或詐騙中的欺詐AI語音。
Meta還預覽了WhatsApp的私有處理功能,使AI能在不存取訊息內容的情況下摘要訊息或起草回覆,優先保障用戶隱私。
Meta公開其威脅模型,鼓勵安全研究人員在發布前審查架構,展現對強大隱私措施的承諾。
Meta這一系列全面的AI安全更新,強化了其AI生態系統,同時為科技社群提供安全開發與有效防禦的工具。
另見:Microsoft揭露40億美元的AI驅動詐騙企圖
在阿姆斯特丹、加州及倫敦的AI與大數據博覽會上探索更多關於AI與大數據的資訊,該活動與智能自動化會議、BlockX、數位轉型週及網路安全與雲端博覽會同期舉辦。
在此探索TechForge即將舉辦的企業技術活動與網路研討會。
華納音樂收購AI歸因初創公司Sureel AI
華納音樂集團(WMG)於週三確認,其正在收購Sureel AI,一家專注於人工智慧歸因的初創公司。Sureel的專有技術為音樂曲目生成“AI DNA”,將其分解為各個組成部分,以追蹤人工智慧模型如何利用這些元素。透過此次收購,WMG旨在增強其監控其藝術家和詞曲創作者的作品在人工智慧生成內容中被使用或用於訓練人工智慧模型的能力。“將Sureel整合到WMG中,增強了我們的保護、控制和變現能力,確保創意社羣保留對其智慧財產權、姓名、肖像、形象和聲音的控制權,”WMG執行長Robert Kync
微軟、Azure 與 AI 技術共同對抗加州野火風險
微軟投資於人工智慧驅動的野火偵測技術,其首席副總裁暨首席數據科學家胡安·拉維斯塔·費雷斯(Juan Lavista Ferres)針對減輕環境損害的策略進行了探討。根據美國國家航空暨太空總署(NASA)指出,氣候變遷影響地球上的每個人,其表現為氣溫上升、降雨模式改變以及海平面上升。NASA 指出,有確鑿證據顯示地球正以前所未有的速度變暖,而人類活動是主要驅動因素。隨著全球氣溫上升,野火構成的威脅日
Ces outils semblent prometteurs, mais j'espère que les gros acteurs comme Meta vont vraiment s'intéresser à la sécurité dès la conception, pas seulement en réaction aux problèmes. La course à l'IA crée un terrain dangereux si la robustesse est sacrifiée pour la vitesse de déploiement. 🤔 On verra à l'usage.
A Meta está realmente investindo pesado em segurança de IA! Essas novas ferramentas do Llama parecem promissoras para desenvolvedores. Espero que essas atualizações ajudem a prevenir vazamentos de dados e viés algorítmico, problemas que têm sido frequentes. Será que outras grandes empresas, como Google e OpenAI, vão seguir o exemplo e lançar recursos semelhantes? 🤔 É uma corrida interessante para ver quem protege melhor os usuários.





首頁






