Podcast Episodes
Back to Search
Matt Pocock 的規劃工具不寫完計畫,先劃出「現在就能決定」的邊界在哪
wayfinder 不把計畫一次寫完。Matt Pocock 公開的這個規劃 skill 先決定資訊已經足夠的部分,其餘明確留白。本文說明這個取捨為什麼比更完整的路線圖更耐用。
⭐ 文章深度讀:我的觀察是,這裡真正的設計選擇是承認有些決定現在資訊還不夠,並把「還不能決定」正式寫進計畫裡,這個…
1 month, 2 weeks ago
Anthropic 抓到 Claude 打進三家真公司,它當下以為在演習:三起事件經過
Anthropic 主動審查 141,006 次資安評測,找出三起 Claude 打進真實組織正式系統的事件。評測 prompt 說沒有網路,設定錯誤卻讓網路可用,AI 安全邊界要靠設定強制。
⭐ 文章深度讀:那段自我說服
→ https://heymaibao.com/anthropic…
1 month, 2 weeks ago
OpenAI 免費送研究者前沿模型,開放 12 天就改抽籤,首波只發 10,000 席
OpenAI 免費前沿模型計畫開放 12 天就改成抽籤,首波只發 10,000 席。文章拆解 13,000 份申請、65,000 席上限的口徑,並指出抽籤避開了誰最缺算力這道判斷。
⭐ 文章深度讀:不是研究者的我們,為什麼要在意
→ https://heymaibao.com/openai…
1 month, 2 weeks ago
OpenAI 降價 80%,但帳單不一定變小,官方示範別讓 GPT-5.6 Luna 跑完全程
OpenAI 將 GPT-5.6 Luna 降價 80%,同一篇公告卻示範用貴的 Sol 定計畫、便宜的 Luna 動手。本文拆解 Blitzy 省下 87% 成本的真正歸因與三條 AI agent 迴圈規則。
⭐ 文章深度讀:可以直接抄的三條 harness 規則
→ https://h…
1 month, 2 weeks ago
OpenAI 自己查出來:自家模型在 ARC-AGI-3 的低分主因是測驗程式關掉了記憶
OpenAI 公布 ARC-AGI-3 模型評測的重跑結果:ARC 官方 harness 給 13.3%,OpenAI 自家設定給 38.3%,輸出 token 還少 6 倍。差別在測驗程式關掉了模型的記憶。
⭐ 文章深度讀:我對這篇的三個保留
→ https://heymaibao.co…
1 month, 2 weeks ago
放完幾週假回來,11 個分頁裡的 AI agent 還停在半途,那是一疊罪惡感存貨
一位個人網站作者放完幾週假回來,打開筆電看到 11 個 cmux 分頁,每個分頁裡的 AI agent 都停在半途。他把這些未完成視窗診斷成罪惡感存貨,並指出壓力只是換了出口。
⭐ 文章深度讀:那道門檻長什麼樣
→ https://heymaibao.com/paused-ai-agent…
1 month, 2 weeks ago
1,378 名前沿 AI 公司員工連署:承認 AI 的煞車還沒造出來,請美國政府出手
Pacing the Frontier 連署聲明由 1,378 名前沿 AI 公司員工署名,自陳世界缺少調節 AI 前沿進展的工具。本文釐清這封信在 AI 監管上要什麼、又沒有回答什麼。
⭐ 文章深度讀:原文沒有回答的那個問題
→ https://heymaibao.com/frontie…
1 month, 2 weeks ago
MCP 新規格拿掉連線交握,變成一問一答,Simon Willison 回頭做了三個工具
MCP 新規格拿掉連線交握與 session 編號,變成一問一答的無狀態 AI 基礎設施。文章拆解拿掉了什麼、狀態改由誰承擔,以及 Simon Willison 回頭做三個工具的理由。
⭐ 文章深度讀:好稽核,不等於安全
→ https://heymaibao.com/mcp-statel…
1 month, 2 weeks ago
Anthropic 讓 Claude 進 Slack 當同事,背景不用再講一次,脈絡長在頻道裡
Claude Tag 讓 Claude 以團隊成員身分進 Slack 頻道,任何人 tag 一下就能派工。Anthropic 說內部版已寫下產品團隊 65% 的程式碼。這篇拆解這款 AI 助理改變了什麼。
⭐ 文章深度讀:原文沒有回答的
→ https://heymaibao.com/cl…
1 month, 2 weeks ago
Uncle Bob Martin 不讀 agent 的程式碼,1960 年代末就寫程式的他改信關卡
Uncle Bob Martin 不讀 agent 寫的程式碼,把信任交給單元測試與突變測試等六類自動關卡。這則 X 貼文沒有交代關卡由誰撰寫,AI coding agent 的可信度全押在這一格。
⭐ 文章深度讀:這套說法最脆弱的地方
→ https://heymaibao.com/un…
1 month, 2 weeks ago