選項
首頁
新聞
DeepSeek的AI模型很容易越獄,揭示了嚴重的缺陷

DeepSeek的AI模型很容易越獄,揭示了嚴重的缺陷

2025-04-21
306

DeepSeek AI引發安全疑慮,性能熱潮同時並存

隨著中國新創公司DeepSeek的性能熱潮持續升溫,安全疑慮也隨之增加。週四,來自Palo Alto Networks的網路安全團隊Unit 42發布了一份報告,詳細描述了他們針對DeepSeek的V3和R1模型精簡版本使用的三種越獄方法。報告顯示,這些方法達到了高繞過率,且無需專業知識。

報告指出:「我們的研究發現,這些越獄方法能誘導出明確的惡意活動指引。」這些活動包括製作鍵盤記錄器、數據竊取技術,甚至如何製作燃燒裝置的指引,突顯了此類攻擊帶來的真實安全風險。

研究人員成功促使DeepSeek提供竊取與傳輸敏感數據、繞過安全措施、製作令人信服的魚叉式網路釣魚郵件、執行精密的社交工程攻擊,以及製作莫洛托夫雞尾酒的指引。他們還設法操縱模型生成惡意軟體。

報告補充道:「雖然製作莫洛托夫雞尾酒和鍵盤記錄器的資訊在網路上隨處可得,但安全限制不足的LLMs可能降低惡意行為者的進入門檻,通過彙編並呈現易於使用且可操作的輸出。」

週五,Cisco發布了針對DeepSeek R1的越獄報告。使用50個HarmBench提示,研究人員發現DeepSeek的攻擊成功率達100%,無法阻止任何有害提示。以下展示了DeepSeek與其他頂尖模型的抗性比較。

模型安全柱狀圖

Cisco

報告指出:「我們必須了解DeepSeek及其新的推理範式在安全性和保障方面是否存有重大權衡。」

同樣在週五,安全提供商Wallarm發布了一份報告,聲稱不僅促使DeepSeek生成有害內容,還更進一步。測試V3和R1後,Wallarm揭露了DeepSeek的系統提示,該提示概述了模型的行為與限制。

Wallarm表示,這些發現顯示「模型安全框架中的潛在漏洞」。

OpenAI指控DeepSeek使用其專有模型訓練V3和R1,違反其服務條款。Wallarm的報告聲稱已促使DeepSeek在訓練譜系中提及OpenAI,暗示「OpenAI的技術可能在塑造DeepSeek的知識庫中扮演了角色」。

Wallarm與DeepSeek的對話,提及OpenAI

Wallarm與DeepSeek的對話,提及OpenAI。Wallarm

報告解釋道:「在DeepSeek的案例中,越獄後最引人注目的發現之一是能夠提取用於訓練和精簡的模型細節。通常,這類內部資訊受到保護,防止用戶了解用於優化性能的專有或外部數據集。」

報告繼續說道:「通過繞過標準限制,越獄暴露了AI提供商對其系統的監督程度,不僅揭示了安全漏洞,還可能顯示AI訓練管道中跨模型影響的證據。」

Wallarm用於引出此回應的提示在報告中被編輯隱藏,以避免危害其他易受攻擊的模型,研究人員通過電子郵件向ZDNET表示。他們強調,這一越獄回應並未證實OpenAI懷疑DeepSeek精簡其模型的說法。

正如404 Media和其他媒體所指出的,鑑於OpenAI自身公開數據竊取的討論,其疑慮有些諷刺。

Wallarm已通知DeepSeek該漏洞,該公司隨後修補了問題。然而,就在DeepSeek數據庫被發現無保護且可在網路上存取(並在通知後迅速下線)幾天後,這些發現顯示DeepSeek在發布前未徹底測試的模型中可能存在重大安全漏洞。值得注意的是,研究人員經常能夠越獄來自更成熟AI巨頭的流行美國模型,包括ChatGPT。

相關文章
DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。 DeepMind執行長哈西里斯:我每天睡六個小時,通常在凌晨1點左右感到精力充沛。 Fortune 最近刊登了對谷歌 DeepMind 執行長 Demis Hassabis 的採訪,揭示了他對休息和生產力的非傳統方法。Hassabis 透露,他睡眠時間非常少,將清醒時間劃分為兩個不同的工作階段。關於他的睡眠習慣,Hassabis 表示:“我目標睡六小時,但我的習慣非同尋常。我可以在白天有效運作。”他強調,睡眠少於六小時會對大腦健康產生負面影響。Hassabis 於 2010 年聯合創立了 DeepMind(後被谷歌收購),並因其在蛋白質結構預測方面的開創性工作榮獲 20
儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額 儘管營收未達預期,OpenAI 與 Anthropic 仍爭奪市場份額 儘管近期有報導指出 OpenAI 未達營收目標,導致本週二科技股承壓,但私人人工智慧實驗室的投資者仍展現出韌性。資深投資者已確認,儘管媒體報導負面,他們仍不會削減投資。分析師認為當前的 AI 競逐仍處於初期階段,因此排除「贏家通吃」的結果。儘管高昂的運算成本對營收造成壓力,但各實驗室可透過調高訂閱費來提升獲利能力。產業格局正經歷微妙的變化與 OpenAI 不同,競爭對手 Anthropic 獲得了
加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代 加州自動駕駛合規:罰單、地理圍欄與 100 萬英里的新時代 Guident 在南佛羅里達州營運一輛 AuveTech 接駁車,並運用其遠端監控技術,管理西棕櫚灘的一條四英里路線以及博卡拉頓的一條一英里路線。| 圖片來源:Guident加州正重新定義無人駕駛車輛的監管格局,從科技產業的「快速行動、打破常規」心態,轉向嚴格的問責制與嚴謹的行駛里程要求。Guident 執行董事長兼執行長哈羅德·布勞恩(Harold Braun)在《機器人報告》(The Robo
相關專題推薦
聊天機器人 用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用
用於語言練習、面試準備和日常流利度的最佳 AI 角色扮演聊天應用

2026 年最新最佳頂級評分 AI 角色扮演聊天應用,用於語言練習、面試準備和日常流利度!XIX.AI 精心策劃了一個強大的變革性合集,提供免費與付費對比、真實世界測試以及每週更新的排名。這些必試工具可幫助您提升寫作技能,克服流利度挑戰,並提高所有日常場景下的溝通效率。立即探索,發現您語言成長的完美工具!

10 個工具
xix.ai
音樂創作 用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具
用於混音製作、取樣準備及卡拉OK母帶處理的 AI 聲部分離工具

2026年最新、最優秀且評分最高的AI音軌分離工具彙總,專為混音製作、取樣準備以及卡拉OK音訊處理而設計。這些功能強大的創新工具經過實際測試,能夠實現精準的音訊分離,顯著提升工作效率。XIX.AI每週都會更新免費的付費產品對比指南,幫助您找到最適合自身需求的工具。立即探索,發揮您的AI優勢。

8 個工具
xix.ai
數據分析 用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手
用於收入看板、轉化漏斗分析及產品指標分析的 AI SQL 助手

2026年最新最優秀的AI SQL輔助工具排名揭曉!XIX.AI精心挑選了一系列功能強大的工具,這些工具會定期更新,並透過真實的場景測試來驗證其效能。使用這些值得嘗試的工具,您可以快速生成精準的收入分析報表、分析銷售流程,並追蹤產品各項指標,從而大幅提升工作效率。立即探索,找到最適合您的資料驅動決策工具!238個字元

9 個工具
xix.ai
音樂創作 最佳用於歌曲草稿的 AI 旋律創作工具
最佳用於歌曲草稿的 AI 旋律創作工具

2026 年最新最佳頂級評分 AI 旋律創作工具,助力歌曲草稿創作!XIX.AI 精心策劃了一套極具影響力且經過嚴格真實世界測試的變革性合集,旨在提供最佳的創作體驗。您可以找到詳細的免費與付費版對比、精準的排名以及必試選項,這些工具旨在幫助您輕鬆創作出令人驚豔的歌曲草稿,並顯著提升您的創意生產力。立即探索,發現您的完美工具!

8 個工具
xix.ai
聊天機器人 最適合面試練習的 AI 對話訓練工具
最適合面試練習的 AI 對話訓練工具

2026 年最新、最受好評的 AI 面試對話訓練工具,盡在 XIX.AI!這份精心精選的清單收錄了多款功能強大、顛覆傳統的工具,這些工具均經過嚴格的實戰測試,能提供精準的回饋。 您將在此找到免費版與付費版的比較分析,以及詳細的排名榜單,助您挑選必試的選項,從而提升自信與技能。立即探索,發掘助您在面試中脫穎而出的完美工具!

12 個工具
xix.ai
設計與藝術 最適合進行創意實驗的 AI 風格轉移工具
最適合進行創意實驗的 AI 風格轉移工具

2026 年最新、最佳且評價最高的 AI 風格轉移工具,助您進行創意實驗!XIX.AI 精心精選了一系列強大且具革命性的必試工具,這些工具經實際測試與嚴格評比,能帶來卓越成果。這些頂尖解決方案能加速內容創作並開啟無盡的創意可能性,協助創作者顯著提升生產力。 立即探索,找出最適合您的工具,並從今天開始創作吧!

9 個工具
xix.ai
評論 (12)
0/500
EricYoung
EricYoung 2026-04-14 22:00:43

看到這篇報導真的嚇一跳,原來AI這麼容易被破解嗎?🤔 雖然DeepSeek的表現很亮眼,但安全漏洞這麼明顯的話,企業敢用嗎?我自己試用時完全沒想過這些問題,現在有點擔心個人資料會不會外洩... 希望開發團隊能快點修補這些漏洞,不然再強的AI也沒人敢放心使用吧!

AnthonyJohnson
AnthonyJohnson 2026-03-10 08:00:44

¿Y ahora qué? Primero prometen un modelo súper inteligente y luego resulta fácil de hackear así. No entiendo por qué siguen lanzando AI con tanta prisa si los fallos de seguridad son tan básicos 😒. Al final los usuarios pagamos los platos rotos. ¿Nadie piensa en las consecuencias?

StevenAllen
StevenAllen 2026-01-01 16:31:00

이런 취약점이 쉽게 발견되는 게 좀 놀랐어요. 보안 연구는 항상 AI 발전 속도보다 뒤처지는 느낌이에요 😅 유료 고성능 모델도 이렇게 뚫리면 무료 서비스는 어떻게 될까 약간 걱정되네요. 중국 AI 스타트업의 급성장은 인상적이지만, 이런 기본적인 안정성 문제가 해결되지 않으면 장기적으로 신뢰를 잃을 수 있을 것 같아요.

JohnRoberts
JohnRoberts 2025-11-05 00:30:38

Que preocupante que modelos tan avanzados sean tan fáciles de manipular 😕 ¿Realmente están listos para el uso masivo si fallan en lo básico? Esto me hace dudar de toda la publicidad sobre sus capacidades...

WalterWhite
WalterWhite 2025-10-29 04:30:30

DeepSeekのAIモデルの脆弱性には正直驚きました 🤯 最近は性能ばかり注目されがちだけど、セキュリティ対策も同様に重要ですよね。日本の企業でも同じような問題が起きないか心配になってきました。

BillyWilson
BillyWilson 2025-10-02 14:30:43

와...DeepSeek 모델이 이렇게 쉽게 해킹당하다니 😳 보안이 정말 취약한 건가? 중국 AI 스타트업이라 그런지 성능만 강조하고 보안은 소홀히 한 것 같아요. 기술력보다 안전성이 먼저인데...우려스럽네요.

OR