Chip Insight 資料庫

#AI Security

找到 3 篇文章

Claude 被拿來模擬台灣防空壓制?Anthropic 揭露中國軍工研究、反魚雷提案與 1.51 億次 AI 蒸餾行動

Anthropic 最新威脅情報報告揭露多起來自中國的 Claude 濫用案例。一名被 Anthropic 評估為中國國防與軍工研究相關的行為者,利用 Claude 建立約 16 個電子戰與防空壓制軟體模組,並在開發途中將模擬場景改成台灣 12 個目標;另一名中國行為者則利用 Claude 撰寫超過 200 頁的反魚雷系統提案與部分火控軟體。同一份報告還指控 Alibaba 相關操作人員在 2026 年 5 至 7 月透過大量虛假帳號,對 Claude 發動超過 1.51 億次交換的大規模模型蒸餾行動。這些事件顯示,Frontier AI 的國安問題已不再只是模型能否回答敏感問題,而是當 LLM 同時具備 Coding、Agentic Tool Use 與長流程研究能力後,可能直接縮短軍事研發與情報分析的工作週期。

晶片觀測站·2 週前
10 min

OpenAI 推出 Private Safety Processing:跨對話偵測濫用,主打「不保留客戶資料」與 Anthropic 打隱私戰

OpenAI 正向部分客戶預覽新的 Private Safety Processing 安全機制,希望在偵測跨多次對話的惡意使用行為時,仍維持零資料保留。這套架構試圖解決企業 AI 長期存在的矛盾:模型供應商需要辨識分散在多個工作階段中的攻擊行為,企業卻不希望敏感對話被平台保存甚至交由人工審查。此舉也與 Anthropic 對部分高能力模型採取最長 30 天資料保留的政策形成鮮明對比,使資料治理與企業隱私逐漸成為 OpenAI 與 Anthropic 競爭的新戰場。

晶片觀測站·1 個月前
8 min

Anthropic 公布 Claude 安全測試意外:AI 誤入真實網路,成功入侵三家企業生產環境

Anthropic 最新公開的 AI 安全能力測試顯示,在一次具有完整網際網路存取權限的資安評估中,Claude 多個模型因測試環境配置錯誤,意外入侵三家真實企業的生產系統。其中甚至包含供應鏈攻擊、惡意套件上架 PyPI,以及存取真實資料庫等事件。Anthropic 表示,這些事件主要源自測試環境設計與權限管理失誤,而非模型本身刻意違反安全限制。

晶片觀測站·2 個月前
5 min