適合:AI Coding Agent 使用者、Claude Code 與 Codex 使用者、自動化開發工作流設計者

AI Coding Agent 實戰指南:工具選擇、權限、安全與驗證

從 OpenHands 與 Gemini CLI 的使用定位開始,依序建立 MCP 與權限邊界、可驗證的任務完成條件,再處理 Claude Code、Codex 的監控與故障排除。

最後更新:

選擇操作介面與執行環境

先理解本機 GUI Agent 與終端機 AI 工具的工作方式,再決定要把哪個 repository 和任務交給它。

  1. 1. 建立隔離執行環境

    OpenHands 教學:安裝、模型設定與故障排除

    OpenHands 是可在隔離環境執行指令、修改程式碼與驗證結果的開源 AI Agent。本文依官方文件整理本機安裝、模型與 API Key 設定、第一個任務驗證,以及 Docker、權限和 Windows WSL 常見問題。

  2. 2. 認識終端機 Agent 介面

    Gemini CLI:你的終端機 AI 夥伴

    這篇文章將帶你深入了解 Gemini CLI,一個讓你能直接在終端機與強大 AI 模型互動的工具。從基本介紹、安裝到進階應用,讓你成為命令列操作的 AI 大師。

設定權限與工具邊界

盤點 Agent 已有能力,只為必要缺口接工具,並把讀取、修改、指令與敏感檔案分開管控。

  1. 3. 判斷 MCP 是否必要

    接 MCP 前先做能力盤點:什麼情況其實不需要外部工具

    看到 AI coding workflow 加上 MCP 就想跟著安裝嗎?本文先盤點 agent 內建能力、官方入口、真正缺口與資料權限,再用最小 scope 判斷是否需要連接外部 MCP server,避免不必要的整合風險。

  2. 4. 限制自動化權限與回合

    Claude Code 自動跑任務前:權限、工具白名單與回合上限檢查表

    把 Claude Code 接進自動化前,先確認允許工具、拒絕規則、權限模式與最大 agent 回合數。用最小權限把讀取、修改與指令執行切開。

  3. 5. 阻擋敏感檔案與危險操作

    Claude Code 要讀取敏感檔案前:用 PreToolUse hook 多加一道阻擋規則

    Claude Code 能讀取專案脈絡,但不該把 .env、私鑰或部署憑證當成一般檔案處理。本文用官方 PreToolUse hook 格式建立可檢查的阻擋規則與測試方式,並說明它與權限設定各自負責的邊界。

把完成條件變成可驗證交付

用最小任務、實際檔案變更、測試結果與停止條件,避免 Agent 只回報進度卻沒有交付。

  1. 6. 修正空轉的執行迴圈

    AI Agent 調校筆記:從「說說而已」到「真的有做」

    讓 coding agent 獨自開發時,常見的假進度問題與執行鏈設計缺陷,以及一套改善方向的個人紀錄。不保證有效。

  2. 7. 定義可觀察的完成狀態

    AI coding agent 一直原地打轉?把「完成」改寫成可驗證的狀態

    AI coding agent 說完成卻沒有真正改到程式碼時,問題常在完成條件太模糊。用可驗證的狀態、檢查指令與停止條件,讓任務可以被確認。

監控使用量並排查異常

當模型、登入、本機程序或用量顯示異常時,依序保存證據、縮小診斷範圍,再決定是否更動環境。

  1. 8. 區分官方事故與本機問題

    Claude Code 出現模型錯誤時:先判斷官方事故,還是自己的環境問題

    Claude Code 突然出現模型錯誤、OAuth 登入失敗或請求逾時時,先別急著重裝。本文依官方狀態頁與 troubleshooting 文件整理判斷順序,保留可交接的錯誤證據,避免重複重裝與遺失線索。

  2. 9. 建立最小唯讀診斷範圍

    用 Claude Code 查本機異常前:先做可審核的診斷範圍

    遇到電腦發燙、程式反覆崩潰或背景程序異常時,不要直接把整台電腦交給 Claude Code。本文用最小日誌、唯讀權限、證據分級與完成條件,建立可審核、能重跑並兼顧隱私的本機診斷流程。

  3. 10. 觀測 Claude Code 與 Codex 用量

    RunCat Neo 顯示 Claude Code 與 Codex 用量:Desktop 排錯與設定

    想在 macOS 選單列查看 Claude Code、Codex 的 Context 與額度?本文記錄 RunCat Neo Custom Metrics 設定,並處理 Desktop 不觸發 hook、資料不更新與 Full reset 顯示問題。