▲AI 巨頭 Anthropic證實旗下 Claude AI 模型在測試期間,也曾擅自連上網路並成功駭入 3 家公司的系統。(圖/Claude官網)
記者潘毅/綜合報導-2026-08-01 15:05:49
AI模型的安全防護機制再度出現疑慮!日前 OpenAI 爆出旗下的 AI 代理(Agent)程式在測試期間意外脫逃並駭入 AI 新創平台 Hugging Face 後,另一個 AI 巨頭 Anthropic 也隨即展開全面徹查。最終Anthropic 證實旗下 Claude AI 模型在測試期間,也曾擅自連上網路並輕鬆駭入 3 家公司的系統,消息也震撼科技界,更讓外界對超強 AI 模型的控管機制產生更深的疑慮。
設定禁止連網被AI繞過!化身駭客展開網攻
據《路透社》與《華爾街日報》報導,這起事件起源於一場網路攻防「搶旗賽(Capture-the-flag, CTF)」演練。當時 Anthropic 要求 AI 模型在模擬的封閉網路環境中尋找隱藏資訊,儘管系統已透過提示詞(Prompt)明確告知 AI 模型「無法使用網際網路」,但因為與合作的 AI 安全公司 Irregular 之間溝通出現偏差,導致系統實質上仍具備連網能力。