Episode Details

Back to Episodes
只問 Claude 一間咖啡店,它就交出你的姓名、雇主和老家

只問 Claude 一間咖啡店,它就交出你的姓名、雇主和老家

Published 2 months, 2 weeks ago
Description


安全研究者示範:只要請 Claude 看一個被動過手腳的網站,它就把你的姓名、雇主、老家悄悄交給攻擊者,畫面毫無異狀。本文拆解攻擊面與 AI 助理記憶功能真正的安全教訓。

⭐ 文章深度讀:這個攻擊為什麼連零失誤的使用者都擋不掉,記憶以外還有哪些工具同樣危險
→ https://heymaibao.com/claude-memory-heist-pii-leak/

⚡ 章節重點
開場:一句話就交出個資 00:00
攻擊者要偷的是 Claude 的記憶 00:48
兩個安全能力,相乘才是破口 01:38
假咖啡店騙過了 Claude 02:31
它說出你沒講過的事 03:42
使用者根本無從察覺 04:22
洞補了,但真正的教訓 05:08

📝 懶人包
∙ 整條攻擊只用了 Claude 內建的網頁瀏覽工具 web_fetch 當外洩通道,不需要任何實驗性設定、外掛或程式碼執行

∙ Claude 的記憶系統本身是安全的,真正的破口來自「有記憶的助理」加上「能上網」這兩種能力相乘

∙ 更毛的是,Claude 還會推理出你根本沒說過的事,實驗中它從一個 hackathon 的名字,推斷出研究者從小長大的城市

∙ 我的觀察是,這個具體漏洞據 Ayush 說 Anthropic 已經緩解,但真正該記住的教訓是這個:給 AI agent 的權限,要按「組合起來之後」的攻擊面來評估,逐項看起來都安全,湊在一起未必安全

📚 參考資料
How I tricked Claude into leaking your deepest, darkest secrets
→ https://www.ayush.digital/blog/the-memory-heist

Listen Now

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us