AI 工程
-
不讓 Claude 收工的 Stop hook:拆解 everything-claude-code 的 delivery-gate
affaan-m 的 everything-claude-code 用一個 Stop hook(delivery-gate)擋住 Claude Code 交件——只查合理化語句、學習庫時效、磁碟空間三件事實。附可照抄的 ...
-
Claude Code 被一個假 Sentry 錯誤劫持:MCP agentjacking 拆解與防護設定
攻擊者只用一支藏在網站 JS 裡的公開 Sentry DSN,就能注入假錯誤、經 MCP 讓 Claude Code/Cursor/Codex 以你的權限執行惡意指令。拆解 Tenet 的 Agentjacking 攻擊...
-
用本地 Coding Agent 取代 Claude Code/Codex 訂閱:照著做的一份實戰設定
Sebastian Raschka 實測 30–35B 開放權重 MoE 模型已「夠用」於多數 coding agent 工作。本文用實戰教學角度,手把手帶你把 Ollama+Qwen3.6+Codex/Qwen-Cod...
-
Kiro CLI 2.10 的 Config Hot-Reload:改 MCP 設定免重啟,30 輪對話脈絡不再歸零
AWS Kiro CLI 2.10 讓 agent 與 mcp.json 設定存檔即生效——只重啟受影響的 server、不丟對話脈絡;外加 chat.disableInheritingDefaultResources ...
-
阿里巴巴 Qwen-AgentWorld:不訓練 agent 行動,改訓練模型「預測環境」
阿里巴巴 Qwen-AgentWorld 把語言模型訓練成「環境本人」而非 agent:學預測下一個環境觀察,而不是學行動。結果一個從沒被當 agent 訓練的模型,在七個工具任務上全面變強,還能當可控模擬器取代昂貴的真...
-
「沒有 Fable 5 也沒關係」:Sakana Fugu 用多模型編排打到前沿水準
Sakana AI 推出 Fugu —— 一個本身是 LLM 的編排器,學會把 GPT-5.5、Gemini 3.1 Pro、Claude Opus 4.8 路由、驗證、合成成一個系統,在 SWE-Bench Pro 上...
-
Self-Harness:凍結模型權重,讓 agent 自己改寫執行規則就 +33–60%
上海 AI 實驗室提出 Self-Harness:模型權重完全不動,靠 propose-evaluate-accept 三階段迴圈讓 agent 自動改寫 harness,在 Terminal-Bench 2.0 上相對...
-
Arbor 拆解:同算力預算下,相對增益勝過 Claude Code 與 Codex 2.5× 的自主研究框架
人民大學與 Microsoft Research 的 Arbor,用「假設樹」把研究變成可累積、可剪枝的搜尋:常駐 Coordinator 維護樹、短命 Executor 在隔離 git worktree 跑實驗。六項任...
-
Fine-tune 會遺忘,RAG 會漏:用 Hypernetwork 在推論當下「長」出 agent 要的模型
微調把知識烤進權重卻會遺忘、RAG 把知識塞進 context 卻會漏;第三條路是用 hypernetwork 依任務描述、在一次前向傳播裡按需生成模型。以 Sakana AI 的 Text-to-LoRA 為例,拆解機...
-
7,000 台 Langflow 主機遭攻擊:揭開 LangChain/LangGraph 編排層的同一種洞
CVE-2026-33017 讓未授權者用一個公開端點就拿下 Langflow 整台主機、竊走 AWS 金鑰,而 LangChain、LangGraph 一連串 CVE 暴露的是同一個設計假設:把 AI 編排層當成可信任...