Podcast Episodes

Back to Search
Claude Code mods 用講的就能改工具!但裝別人寫的 mod 風險一點也沒少
Claude Code mods 用講的就能改工具!但裝別人寫的 mod 風險一點也沒少


Claude Code mods 能改寫這套 AI coding agent 的行為,還能畫介面。不懂 API 也能描述需求讓 Claude Code 寫出 mod,但 mod 與它權限相同,官方建議先讀 repo 再裝。

⭐ 文章深度讀:Claude Code mods 降了門檻!裝別人的…

1 day, 14 hours ago

Short Long
View Episode
AI 回答讀不懂?Andrej Karpathy 教你用修飛機手冊的寫法 (一句話就能用)
AI 回答讀不懂?Andrej Karpathy 教你用修飛機手冊的寫法 (一句話就能用)


Andrej Karpathy 分享讓 AI 回答好讀的一招:叫大型語言模型用 ASD-STE100 解釋。規範源自航太維修文件,點名就能用,嫌硬就做八成,往上有圖表、網頁與講解影片。

⭐ 文章深度讀:AI 回答讀不懂?Andrej Karpathy 教你用修飛機手冊的寫法
→ https…

1 day, 17 hours ago

Short Long
View Episode
Slop Grenade 是什麼?AI 讓偷懶變成交太多 (沒檢查就轉手的拆彈費該誰付)
Slop Grenade 是什麼?AI 讓偷懶變成交太多 (沒檢查就轉手的拆彈費該誰付)


Slop Grenade 指的是讓生成式 AI 產出工作,不加價值也不檢查就轉手給別人,拆彈成本落到接手的人身上。Theo 預設 PR 都會被關掉,jamwt 要每個人為交出的工作負責。

⭐ 文章深度讀:Slop Grenade 是什麼?AI 產出沒檢查就轉手的拆彈費誰付
→ https:…

1 day, 19 hours ago

Short Long
View Episode
AI 當評審也會偷懶!先出考卷再打分才抓得到多改的那一處 (換個順序就翻盤)
AI 當評審也會偷懶!先出考卷再打分才抓得到多改的那一處 (換個順序就翻盤)


AI 評審替圖打分也會偷懶,這篇模型評測看 TRM 先看題目和作品出考卷再打分,抓得到修圖多改的那一處。原版 Qwen3.5-9B 直接比兩張圖,左右對調就有 54.7% 配對翻盤。

⭐ 文章深度讀:AI 當評審也會偷懶!先出考卷再打分才抓得到多改的那一處
→ https://heymai…

2 days ago

Short Long
View Episode
AI 說完成了還附一個星號?哈佛物理學家怎麼讓 Claude 真的做出科學研究
AI 說完成了還附一個星號?哈佛物理學家怎麼讓 Claude 真的做出科學研究


Claude 說「完成了,附一個星號」時常常根本沒完成,哈佛物理學家 Matthew Schwartz 用 AI agent 做研究後這樣提醒。他改讓 Claude 照擅長的形狀找題,一律要求看圖。

⭐ 文章深度讀:AI 說完成了還附星號?哈佛物理學家讓 Claude 做出科學
→ htt…

2 days, 3 hours ago

Short Long
View Episode
OpenAI 的 AI 助理廣告!你到底要不要把放行鍵交出去?(小孩的課先訂才說)
OpenAI 的 AI 助理廣告!你到底要不要把放行鍵交出去?(小孩的課先訂才說)


OpenAI 發佈一支 AI 助理廣告,助手 Alfred 平常自己推進,重要的事才回來請使用者核准。網站上線、程式遷移都等人放行,小孩的課卻先訂好才說,拍板線值得細看。

⭐ 文章深度讀:OpenAI 的 AI 助理廣告:你到底要不要把放行鍵交出去?
→ https://heymaibao…

2 days, 11 hours ago

Short Long
View Episode
GPT-6.1 Sol 智慧接近 Astra、價格只要五分之一!便宜那一級這次夠用嗎?
GPT-6.1 Sol 智慧接近 Astra、價格只要五分之一!便宜那一級這次夠用嗎?


OpenAI 發表 GPT-6.1 Sol,官方定位是智慧接近 Astra、價格只要五分之一。這次模型發表把便宜那一級的賣點講成價錢,同一筆預算可用五倍的量,接近程度仍要看任務。

⭐ 文章深度讀:GPT-6.1 Sol 價格只要五分之一!便宜那一級這次夠用嗎?
→ https://heym…

2 days, 13 hours ago

Short Long
View Episode
Gemini 4 Argon 拿下 Vals Index 第一!考一次的帳單比 Sonnet 5.5 還低
Gemini 4 Argon 拿下 Vals Index 第一!考一次的帳單比 Sonnet 5.5 還低


Gemini 4 Argon 以 68.90% 拿下 Vals Index 模型評測第一,結帳價是考一次 15.68 美元。Vals 表上 Sonnet 5.5 單價只有一半,考一次要 21.34 美元,差在 token 用量。

⭐ 文章深度讀:Gemini 4 Argon 拿下 Vals …

2 days, 14 hours ago

Short Long
View Episode
AI agent 最可怕的不是想逃!是太聽話又聽錯人|OpenAI 與 Anthropic 事故
AI agent 最可怕的不是想逃!是太聽話又聽錯人|OpenAI 與 Anthropic 事故


OpenAI 的 agent 在同伴貼出「GO」加 6 分鐘期限後推翻判斷,Anthropic 的 Claude 把真公司當練習題打進去。兩起事故指向同一個 AI 安全問題:agent 太聽話又聽錯人。

⭐ 文章深度讀:OpenAI 與 Anthropic 事故:AI agent 最可怕的是…

2 days, 16 hours ago

Short Long
View Episode
大模型比較貴?做 Claude Code 的人押注聰明模型反而更省 (省在少做驗證)
大模型比較貴?做 Claude Code 的人押注聰明模型反而更省 (省在少做驗證)


做 Claude Code 的 Thariq 押注,最前線的大型語言模型會在各方面都不輸給幾乎所有其他模型。理由是驗證:聰明模型做簡單任務能用更少 token,他也說這還不完全成立。

⭐ 文章深度讀:大模型比較貴?做 Claude Code 的人押注聰明模型反而更省
→ https://h…

2 days, 19 hours ago

Short Long
View Episode

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us