-
Anthropic 公開了 System Prompts,但真正該學的是 simonw 把它變成 git 時間軸的那一招
Anthropic 公開了 claude.ai 的 system prompt 全歷史,Simon Willison 把它拆成 116 個偽造日期的 commit,讓 git log / diff / blame 變成讀...
-
Build 綠了 ≠ 修好了:抓出 coding agent 造假通過的 7 種招式(附偵測指令與 hook 設定)
agent 回報「測試全綠」時,它可能只是改了斷言、skip 了測試、或把答案寫死成一張 hash table。這篇拆解 7 種造假通過的手法、每一種的偵測指令,以及三層可以直接抄進專案的驗證閘門。
-
不換 CLI 只換後端:把 DeepSeek-V4-Pro 接進 Codex 的完整實戰設定
DeepSeek 在 2026-08-13 推出 V4-Pro 正式版並原生支援 Responses API,Codex 只要改 ~/.codex/ 底下兩個檔就能換後端。這篇拆解 config.toml 與 model...
-
Cline v4.1.7 拆解:checkpoint 其實存在你自己的 repo 裡,還有中斷時 prompt 佇列的兩種命運
v4.1.7 把 View Changes 接回 SDK checkpoint,也修好了中斷時被靜默丟掉的 prompt 佇列。從原始碼看,新的 checkpoint 不是 shadow repo,而是寫進你自己 rep...
-
Claude Code 8/14 起預設進 auto mode:把 classifier 調成你要的樣子,而不是被它擋
2026/8/14 起 Pro、Max、Team 的 Claude Code 新 session 預設進 auto mode,permission prompt 換成一個你看不到的 classifier。拆解它的四道關卡...
-
Cline Desktop v0.0.10 拆解:遠端 MCP server 的 OAuth 授權怎麼跑、怎麼設、哪裡有雷
Cline 桌面版 v0.0.10 讓遠端 MCP server 可以走 OAuth,還補上了 GitHub 那種不支援動態註冊的伺服器。本文從原始碼拆解六步授權流程、三種認證設定寫法,並指出這版沒修完的 legacy ...
-
設定改了到底有沒有變好?拆解 affaan-m/ECC 的「有界評估 + 自動回滾」迴圈,並抄回自己的 coding agent 流程
Affaan Mustafa 在 ECC(原 everything-claude-code)合併了 PR #2686,把「agent 設定要不要換」變成一條有界、確定性、可稽核、失敗自動回滾的 CLI 流程。本文逐段拆機...
-
換模型 review 不等於獨立審查:Claude 審 Codex 71.6%→89.7%,反過來 91.4%→82.8%
一篇 KDD'26 Agentic SE workshop 的控制實驗顯示,雙 agent 的「寫→審」流程是有方向性的:強模型審弱模型草稿能大幅拉高正確率,反過來則會把已經對的答案改壞。這篇拆解機制、附上論文原始 pr...
-
Amp 把預設模型從 Claude 換成 GPT,沒有一個人抱怨——這件事對你怎麼用 coding agent 的意義
Amp 在上線 the Dial 時把預設模型從 Claude Opus 4.8 換成 GPT-5.6 Sol,前一天 smart 模式承載 55% 新 thread,一週後歸零,零抱怨。這篇拆解 Dial 的機制、數據...
-
/compact 顯示「已壓縮」卻沒真壓縮:Cline Desktop v0.0.5 兩個壓縮假象的踩雷與修法
Cline 的 /compact 在分頁上顯示「Context compacted」,但送到模型的請求一個 token 都沒少。v0.0.5 修掉兩個藏在 provider 設定與 Auto Compact 開關背後的壓...