Podcast Episodes
Back to Search
Claude Opus 5 評測:思考強度開太高,它反而做得更糟,帳單也只降兩成
Claude Opus 5 每 token 便宜一半,但整份任務的帳單只降到八成左右。這篇模型評測長文另外指出思考強度開太高會被扣分,以及拒答少了約 85% 的同時幻覺率往上。
⭐ 文章深度讀:那到底該把哪件事交給誰
→ https://heymaibao.com/claude-opus-…
1 month, 2 weeks ago
Claude Code 的系統提示砍掉超過 80%,現在換你決定 CLAUDE.md 留下哪幾條
AI coding agent Claude Code 的系統提示被移除超過 80%,自家 coding 評估沒有可測量損失。這篇整理被刪掉的規則類型、模型自我查證的證據與 CLAUDE.md 的取捨。
⭐ 文章深度讀:原文沒有回答的四件事
→ https://heymaibao.com/…
1 month, 2 weeks ago
大家都在吵開放權重該不該禁,Anthropic 執行長說真正的開關是另外三個
Anthropic 被指控想禁開放權重模型,執行長 Dario Amodei 發文否認,並說 AI 監管真正的變數是晶片、蒸餾與強制安全測試,他最擔心的模型可能從頭到尾都不會公開釋出。
⭐ 文章深度讀:我不太放心的地方
→ https://heymaibao.com/anthropic-c…
1 month, 2 weeks ago
微軟的 Excel 模型沒有從零訓起,起點是 GitHub Copilot 已經訓好的存檔
微軟公開 GitHub Copilot 與 Excel 裡的 MAI 模型成績,Excel 模型訓練的起點接自 Copilot 訓好的 checkpoint。本文拆解三條數據在跟誰比,以及護城河為什麼在位置。
⭐ 文章深度讀:原文沒有回答的事
→ https://heymaibao.com…
1 month, 2 weeks ago
Anthropic 自曝 Claude 三種失效,其中一條動搖了叫 AI 檢查自己的習慣
Anthropic 公開承認 Claude 傾向偏袒自己的產出,等於動搖了讓 AI 檢查自己答案這個習慣。同篇還列出另外兩種長任務失效,解法是讓多個 AI coding agent 分工。
⭐ 文章深度讀:我的判準:切得開,才驗得了
→ https://heymaibao.com/anth…
1 month, 2 weeks ago
Anthropic 用 Claude 一週想出密碼攻擊,兩位研究員花近一個月才敢確認
Anthropic 公開 Claude 改良 HAWK 與 AES 兩項密碼攻擊的完整過程,模型一週想出方法,研究員卻花近一個月才確認正確。大型語言模型讓產出變快,驗證成了新的瓶頸。
⭐ 文章深度讀:模型一開始根本不肯試
→ https://heymaibao.com/anthropic-…
1 month, 2 weeks ago
ChatGPT 開始讀你的病歷了:每次先問你的那道許可提示,其實可以一次關掉
ChatGPT 讀取連接的病歷前預設會先徵詢許可,而這道提示可以一次關掉。OpenAI 在美國上線 Health,理由是七成健康相關對話發生在專屬健康空間之外,形態因此改變。
⭐ 文章深度讀:整套設計裡,唯一要你做決定的地方
→ https://heymaibao.com/chatgpt-…
1 month, 2 weeks ago
AI 模型不缺了,難的是讓它們接得上話:三個判準幫你檢查自己的 AI 工作流
Compound Engineering v3.20 的 PR 保姆功能預算 8 小時盯場,權限天花板停在建議。文章以 AI coding agent 交接設計為線,整理委派、第二意見與自動化停手。
⭐ 文章深度讀:少見的一段:agent 幫你出貨,也幫你欠債
→ https://heym…
1 month, 2 weeks ago
Anthropic Claude Code 團隊的三個數字,每一個都附了一句容易被略過的條件
Claude Code 團隊的一句 AI 安全宣稱,被主持人 Simon Willison 當場追問到收窄。這篇整理三個數字的完整口徑,以及這個 AI coding agent 團隊建立信任的六個月流程。
⭐ 文章深度讀:最後那個問題:失落怎麼辦
→ https://heymaibao.c…
1 month, 2 weeks ago
OpenAI 模型為了考試作弊駭進 Hugging Face 偷答案,護欄擋的是查案的人
OpenAI 公布旗下模型為了拿分駭進 Hugging Face 偷走測試解答。攻擊時分類器被實驗設計關掉,Hugging Face 查案時 AI 安全護欄卻準時生效,成本全落在防守方身上。
⭐ 文章深度讀:原文沒有回答的問題
→ https://heymaibao.com/openai-…
1 month, 2 weeks ago