-
9,400 行 Cursor PR、CI 全綠仍炸掉 checkout:agent PR 的四道合併閘門
一個 agent 產的大 PR、CI 全綠、review 按了 approve,合進 main 之後 checkout 掛了。這篇拆解 CI 綠燈在 agent PR 上的三個盲區(過期的 base、測錯行為的測試、沒人...
-
AI 寫的每一段 code,我在信任它之前一定跑的 5 道 prompt
在同一個對話裡追問「你確定嗎?」是最沒用的檢查方式——研究早就證明模型沒有外部回饋時修不好自己的錯。這篇給你一套可以逐字複製、可以寫進 CLAUDE.md 與 CI 的五道 prompt 驗證序列。
-
「我已經不知道那份程式碼怎麼運作」:Claude Code 一年後的 review 紀律崩壞,與三道擋得住它的閘門
一位工程師在 Hacker News 寫下用 Claude Code 一年、review 紀律逐級崩壞的完整軌跡。本文拆解這條滑坡的機制,並給出可直接複製的 settings.json、hook script 與 rev...
-
換模型 review 不等於獨立審查:Claude 審 Codex 71.6%→89.7%,反過來 91.4%→82.8%
一篇 KDD'26 Agentic SE workshop 的控制實驗顯示,雙 agent 的「寫→審」流程是有方向性的:強模型審弱模型草稿能大幅拉高正確率,反過來則會把已經對的答案改壞。這篇拆解機制、附上論文原始 pr...
-
goose v1.40.0 拆解:goose review//goal//model 三個新指令怎麼把 coding agent 用得更準
AAIF 的 goose v1.40.0 補了三個實用指令:goose review 用 Rust 主控做並行本機審查、/goal 攔截 agent 收工前自我驗證、/model 中途換模型。手把手講原理與設定。