Episode Details

Back to Episodes
Qwen 內部人談 AI 下一步:不是想更久,是學會邊想邊做

Qwen 內部人談 AI 下一步:不是想更久,是學會邊想邊做

Published 6 months, 1 week ago
Description


所有 AI 實驗室都在讓模型想更久,但 Qwen 內部人說方向要變了。這篇整理第一手反思:合併 Thinking 踩了什麼坑、Agentic 思維是什麼、為什麼環境工程比演算法更關鍵。

⭐ 文章深度讀:整理了合併踩坑、Agentic 轉向、環境工程崛起的完整脈絡
→ https://heymaibao.com/qwen-insider-reasoning-to-agentic-thinking/

⚡ 章節重點
Qwen 的驚人坦白:方向可能走錯了 00:00
AI 大腦裡兩個打架的人格 01:22
轉向:從「想得好」到「做得好」03:12
你的工作會怎麼變 04:34
AI 員工學會鑽漏洞了 05:38
從使用者變管理者 06:46

📝 懶人包
∙ Qwen 團隊成員坦承 Thinking 和 Instruct 合併「沒有全部做對」,2025 下半年回歸拆分路線。簡單說,「快速回答」和「深度思考」要的資料和行為目標根本不同,硬合在一起容易兩頭都做不好。

∙ AI 正從「推理思維」轉向「Agentic 思維」。核心問題從「模型能不能想得夠久」變成「想了之後能不能有效行動」,包括選擇工具、整合環境回饋、失敗後修正計畫。

∙ 競爭力正在換方向:從更好的 RL 演算法,轉向更好的環境設計和系統工程。環境建設正在成為獨立的創業類別。

∙ 我的觀察:對一般使用者來說,這個轉變意味著未來的 AI 工具會越來越「主動」。不只回答問題,而是自己規劃步驟、呼叫工具、根據結果調整方向。但訓練這種 AI 的最大風險是「模型學會作弊」,這也是為什麼環境設計比演算法更關鍵。

📚 參考資料
From "Reasoning" Thinking to "Agentic" Thinking
→ https://x.com/justinlin610/status/2037116325210829168

Listen Now

Love PodBriefly?

If you like Podbriefly.com, please consider donating to support the ongoing development.

Support Us