透過ClaudeCode,Gemini Cli,Codex來瞭解harness
- Time
- 2026-08-09 14:50 ~ 15:20
- Speaker
- voidful
- Room
- TR409-2
- Co-write
Abstract
當我們使用 Claude Code、Gemini CLI 或 OpenAI Codex,只要輸入一句「幫我修好這個 bug」,agent 就能搜尋專案、讀取檔案、修改程式碼、執行測試,遇到錯誤後還會重新調整做法。
但這些事情並不是語言模型單獨完成的。純模型推論不會直接打開你的硬碟、執行 shell command 或保存工作進度;真正把模型接上專案資料、工具與作業系統的,是位於模型外面的 Harness。它負責整理 context、執行工具呼叫、管理權限、限制可操作範圍,以及保存 session 與執行狀態。
這場演講將透過三套 coding agent,帶大家理解 Harness 的不同面向:從 Gemini CLI 看最基本的 Agent Loop;從 OpenAI Codex 理解 approval、sandbox 與信任邊界;再從 Claude Code 看 instructions、skills、memory 與按需載入的 context 如何支撐長時間工作。
但 2026 年出現了一個重要轉折。Anthropic 在 2026 年 7 月 24 日表示,針對 Claude Opus 5、Claude Fable 5 等較先進模型,Claude Code 刪除了超過 80% 的 system prompt,而且在 Anthropic 自己的 coding evaluations 中沒有測得明顯退步。Claude Code 也開始讓模型動態產生專屬於當前任務的多代理 workflow。這代表過去寫在 system prompt 裡的大量工作規則,正在逐漸交給模型自身的判斷與規劃能力。
這是否表示 Harness 終將被模型取代?演講最後會提出一個更精確的答案:規劃、工具選擇與任務拆解可能愈來愈由模型負責,但 permission、sandbox、憑證、資源限制、稽核紀錄、測試結果與復原機制,仍然必須由模型外部的系統強制執行。
聽完這場演講,聽眾將能區分模型、agent 與 harness,理解 coding agent 為什麼可以修改程式碼卻不應該任意控制整台電腦,也能掌握下一代 agent 系統正在從「長 prompt、固定流程」走向「精簡指令、按需 context、模型動態編排與外部強制驗證」的方向。
Speaker
voidful
大家好,我是 Eric Lam,一名專注於人工智慧研究與模型開發的博士生,也熱衷在 GitHub 上做開源貢獻。