Episode Details
Back to Episodes
不看你的資料也能做安全檢查:OpenAI 官方和 Anthropic 工程師同一週宣告
Description
OpenAI 官方帳號與一位在作者名冊登記為 Anthropic 工程師的發文者,在 8 月下旬相隔不到 27 小時分別宣告,AI 安全檢查改成在客戶自己的基礎設施上執行,內容留在原地,只有有限的安全訊號離開。兩則宣告的承諾強度不同,該盯的變數也因此換了一個。
⭐ 文章深度讀:你現在可以做的判斷
→ https://heymaibao.com/openai-anthropic-safety-checks-your-infrastructure/
⚡ 章節重點
開場 00:00
兩家,同一個形狀 00:39
為什麼是現在 03:05
關鍵字是有限的安全訊號 03:56
兩種承諾強度 05:05
你現在可以做的判斷 05:48
📝 懶人包
∙ OpenAI 官方說會繼續為 frontier models (最前沿的那批模型) 提供 Zero Data Retention (資料零留存),同時預覽 Private Safety Processing,目標是在不讓 OpenAI 人員接觸底層內容的前提下改善安全性
∙ 機制骨架來自同一天稍晚的一則說明貼文:在資料零留存的部署下,內容留在客戶控制的基礎設施上,自動化系統跨相關互動找模式,只回傳有限的安全訊號
∙ 隔天,工程師 Thariq Shihipar (@trq212) 在自己的帳號上說要推出運作在客戶自己基礎設施上的 Fable safeguards,已和大約 100 家公司共同開發,希望秋天更廣泛推出
∙ 我的觀察是,這一輪之後,該盯的變數從「他們會不會看」換成「離開我機房的那個東西有多小」
📚 參考資料
We will continue to offer Zero Data Retention for frontier models
→ https://x.com/OpenAI/status/2090165328290701800
Today we're previewing Private Safety Processing
→ https://x.com/thsottiaux/status/2090173536010957128
New Fable safeguards for enterprises that work on your infrastructure
→ https://x.com/trq212/status/2090569474139439335