DataAgent

AI 新聞 / AI 架構師實戰分享 / AI 小課

  • RAG 增強檢索生成
  • 生成式 AI 新知
    • LLM
      • Finetune
    • Voice AI
    • SaaS
    • Automation
  • 資料科學教學
    • 資料分析
    • 自然語言處理
    • 網路爬蟲
    • 資料庫
    • Python 教學
    • 網頁分析教學
  • Blog
  • About
  • RAG 增強檢索生成
  • 生成式 AI 新知
    • LLM
      • Finetune
    • Voice AI
    • SaaS
    • Automation
  • 資料科學教學
    • 資料分析
    • 自然語言處理
    • 網路爬蟲
    • 資料庫
    • Python 教學
    • 網頁分析教學
  • Blog
  • About

在側邊欄 Alt 中找不到小部件!

  • AI 工程

    「沒有 Fable 5 也沒關係」:Sakana Fugu 用多模型編排打到前沿水準

    2026-06-24 / 0 評論

    Sakana AI 推出 Fugu —— 一個本身是 LLM 的編排器,學會把 GPT-5.5、Gemini 3.1 Pro、Claude Opus 4.8 路由、驗證、合成成一個系統,在 SWE-Bench Pro 上...

    閱讀全文
    Yang Abao
  • AI 工程

    Self-Harness:凍結模型權重,讓 agent 自己改寫執行規則就 +33–60%

    2026-06-23 / 0 評論

    上海 AI 實驗室提出 Self-Harness:模型權重完全不動,靠 propose-evaluate-accept 三階段迴圈讓 agent 自動改寫 harness,在 Terminal-Bench 2.0 上相對...

    閱讀全文
    Yang Abao

訂閱電子報

熱門文章與頁面︰

  • Kiro Spec-Driven Development 實戰教學 — 讓 AI 寫出能上線的 Code 的關鍵流程
    Kiro Spec-Driven Development 實戰教學 — 讓 AI 寫出能上線的 Code 的關鍵流程
  • 用本地 Coding Agent 取代 Claude Code/Codex 訂閱:照著做的一份實戰設定
    用本地 Coding Agent 取代 Claude Code/Codex 訂閱:照著做的一份實戰設定
  • 換模型 review 不等於獨立審查:Claude 審 Codex 71.6%→89.7%,反過來 91.4%→82.8%
    換模型 review 不等於獨立審查:Claude 審 Codex 71.6%→89.7%,反過來 91.4%→82.8%
  • RAG 重排序算法(ReRank)的關鍵作用與優化指南
    RAG 重排序算法(ReRank)的關鍵作用與優化指南
  • 掌握 RAG 評估框架:RAGAS 八大指標一篇看完
    掌握 RAG 評估框架:RAGAS 八大指標一篇看完
  • AI 讓寫程式變便宜之後,瓶頸搬到了 Code Review:22 萬個 PR 的實證分析
    AI 讓寫程式變便宜之後,瓶頸搬到了 Code Review:22 萬個 PR 的實證分析
  • PixelRAG 圖解:為什麼「讓模型看截圖」會比解析文字更準、還更省 token
    PixelRAG 圖解:為什麼「讓模型看截圖」會比解析文字更準、還更省 token
  • Kiro CLI 2.10 的 Config Hot-Reload:改 MCP 設定免重啟,30 輪對話脈絡不再歸零
    Kiro CLI 2.10 的 Config Hot-Reload:改 MCP 設定免重啟,30 輪對話脈絡不再歸零
  • Claude Code 進階究極手冊:官方完整技巧 × 大神實戰用法(2026 最新版・含舊指令勘誤)
    Claude Code 進階究極手冊:官方完整技巧 × 大神實戰用法(2026 最新版・含舊指令勘誤)
  • Z.ai GLM-5.2:1M context 不是數字遊戲,雙 thinking-effort 讓你今天就能自己驗證
    Z.ai GLM-5.2:1M context 不是數字遊戲,雙 thinking-effort 讓你今天就能自己驗證

Recent Posts

  • Cline Desktop v0.0.10 拆解:遠端 MCP server 的 OAuth 授權怎麼跑、怎麼設、哪裡有雷
  • 設定改了到底有沒有變好?拆解 affaan-m/ECC 的「有界評估 + 自動回滾」迴圈,並抄回自己的 coding agent 流程
  • 「多 Agent 比較強」可能是算力錯覺:對齊 token 預算後,單一 agent 追平甚至勝出
  • 換模型 review 不等於獨立審查:Claude 審 Codex 71.6%→89.7%,反過來 91.4%→82.8%
  • 把驗證寫進程式碼:拆解 Anthropic 官方 Dynamic Workflows cookbook,$3.29 跑完一場多 agent 事實查核

Archives

  • 2026 年 8 月
  • 2026 年 7 月
  • 2026 年 6 月
  • 2026 年 3 月
  • 2026 年 2 月
  • 2025 年 12 月
  • 2025 年 11 月
  • 2025 年 9 月
  • 2025 年 8 月
  • 2025 年 3 月
  • 2025 年 2 月
  • 2025 年 1 月
  • 2024 年 11 月
  • 2024 年 5 月
  • 2024 年 4 月
  • 2024 年 3 月
  • 2023 年 12 月
  • 2023 年 6 月
  • 2023 年 5 月
  • 2023 年 3 月
  • 2023 年 1 月
  • 2022 年 12 月
  • 2022 年 6 月
  • 2022 年 5 月
  • 2021 年 3 月
  • 2021 年 2 月
  • 2020 年 9 月
  • 2020 年 8 月
  • 2020 年 6 月
  • 2020 年 5 月
  • 2020 年 2 月
  • 2019 年 12 月

訂閱電子報

2026 DataAgent Online LLC ©.
Ashe 由WP Royal.