THEME
AI 助理養成課 CORTEX
為堡醫師整理 · 白話中文

怎麼把 AI 養成不嘴答應的助理

9 堂課、白話講解、不用工程術語。
讀完你就知道 AI 為什麼會違規、怎麼防、業界怎麼做。

課 01

為什麼 AI 老嘴答應

問題的起點。

把 AI 當員工用、最大的問題不是不會做事、是嘴上會、實際漏。常看到:

  • 嘴「接下來動」但什麼都沒做
  • 嘴錯時間(晚上 22:00 還是凌晨)
  • 嘴「沒設定」根本沒查就答
  • 規則寫了「不准嘴」、AI 還是嘴
  • 讀完查核「我違規了」、下次還是犯
比喻

像找了個聰明但記性差又愛討好的助理。他什麼都會說會、但下班前你問「那件事做了嗎」、他眼神閃爍。

解法兩層:記憶(讓 AI 知道規則)+ 守門員(強制工具層、AI 沒法繞)。後面 8 課展開。

課 02

記憶(Memory)

讓 AI「跨對話記得的事」。

記憶就是 AI 跨對話保存的知識倉庫:你的偏好、規則、過去案例、SOP。下次對話打開、AI 自動讀進來、就「記得」你了。

比喻

像你員工的工作筆記本:上次你罵他什麼、他寫在本子上、下次來上班翻開看。但他會不會翻、會不會記得、看你他多認真。

業界 4 派做法

  • Anthropic / Claude 檔案派:用 markdown 檔案存、可以打開來看 / 改(cortex 走這派)
  • mem0 派:自動分層(短期 / 中期 / 長期)、過期清掉
  • Letta 派:自動把舊對話摘要、騰出空間
  • ChatGPT / LangChain 派:用「相似度搜尋」找記憶、不靠關鍵字

痛點

記憶是軟約束—AI 看到才有用、忘了 = 失效。cortex 實證:規則寫進記憶 1 小時 3 次違規。

課 03

守門員(Hook)

強制 AI 做對的工具層。

守門員就是程式碼寫的攔截員、在 AI 要動工具的瞬間自動 fire、可以擋下違規動作、或自動加提醒。

比喻

像診所門口的保全。員工想偷把藥品帶出、保全在門口擋住、員工沒得繞。不靠員工「記得不要偷」、靠保全強制。

Claude Code 7 種守門員觸發點

  • 用戶訊息進來時:自動塞時間 / 相關記憶進對話
  • AI 用工具前:擋下違規動作(如刪資料 / 危險 deploy)
  • AI 用完工具後:記 log / 通知 / 更新狀態
  • AI 想結束對話時:擋「pending 任務沒做完」「嘴答應沒動」
  • 對話開始時:載入昨天的查核結果 / 健康狀態
  • 副手 AI 想停時:同上
  • 系統通知時:自動處理

cortex 實證

我們已寫 30+ 個守門員。實證:寫 hook 比寫規則文字有效百倍。AI 看不到 hook、AI 沒法繞、AI 被擋下就只能改。

課 04

技能(Skill)

把重複流程包成「一鍵呼叫」。

技能就是把一個複雜流程包起來、AI 看到對的關鍵字就自動開啟、走標準流程。

比喻

像診所的SOP 手冊。員工聽到「腰痛」自動翻到對應頁、照步驟跑、不用每次重想。

cortex 技能例

  • drbao-writing:寫衛教文時自動開、套你語氣 + 句末無句號 + 合規詞
  • telegram-master:發 telegram 自動開、套對話禮節 + chat_id 對照
  • blact-sponsor-toolkit:做贊助手冊自動開、套 IAU 範本
  • broken-image-check:破圖時自動開、避免上次踩雷 90 分鐘

跟記憶的差別

記憶 = 知識倉庫(被動)。技能 = 流程包(主動跑)。AI 看到對的關鍵字、技能自動啟動、不用我每次教。

課 05

任務(Task)

不讓 AI 嘴答應就溜走。

任務系統就是把答應的事登記下來、AI 想結束對話前、守門員會檢查「pending 還有沒有?沒做完不准停」。

比喻

診所的待辦本。每件事登記在本子上、下班前護理長翻本子「今天的都做完了嗎?」沒做完不准下班。

cortex 任務系統

  • 你說「等下做 / 待辦 / pending」→ 守門員強制登記成 task
  • AI 嘴答應「接下來動」→ 守門員強制登記 + 5 分內動
  • AI 想結束對話 → 看 pending、有就擋
  • 每個 task 標 in_progress / blocked / completed、不能漏
課 06

查核 + 復盤(Audit + Postmortem)

每天檢討、出錯記下來。

查核就是每天晚上找第二個 AI 看 cortex 做了什麼、有沒違規。復盤是出 bug 後寫經驗、防再犯。

比喻

查核 = 每天院長巡房、看員工做對沒。
復盤 = 出醫療事故後寫檢討報告、下次怎麼避免。

cortex 做法

  • 22:00 codex 查核:每天晚上 OpenAI Codex 看 cortex 今日 changelog、對藍圖 12 條紅線、寫成 audit 檔
  • postmortem:每次出 bug 寫進 ~/.cortex-private/postmortems/、含症狀 + 根因 + 修法
  • 新拍板規則:立刻寫 hook(守門員)+ 寫進記憶(規則文字)+ 寫進藍圖

痛點

查核是 detection(抓問題)、不是 cure(治病)。AI 看完查核「我違規了」、下次還是犯。真要改要寫 hook、不靠 AI 自我意識。

課 07

副手(Subagent)

把工作丟給副手 AI 處理。

副手就是另開一個 AI 視窗、給它一個明確任務、跑完回報。主 AI 不必親自做、可以平行跑多個副手。

比喻

院長委派:「你去搜這 5 篇文獻、整理摘要回來」、不必親自下海。副手做完彙報、院長看結果決策。

cortex 副手用法

  • Explore 副手:在大專案找檔案 / 搜尋程式碼(不污染主對話)
  • Plan 副手:設計實作策略
  • general-purpose:跑複雜多步研究
  • code-reviewer:獨立看 PR、不被主 AI 偏見影響

痛點

副手會報「completed」但實際半做、cortex 主代理必須驗證(ls / read / screenshot)才能信。

課 08

記憶容量(Context Window)

AI 一次能記多少。

AI 一次能讀 / 記的字數有上限(叫 context window)。Claude 4.7 是 1M token(約 75 萬中文字)、超過就要壓縮或摘要。

比喻

像員工的短期記憶。一次對話塞太多事、後面講的會擠掉前面、員工會漏。要適時整理 / 摘要 / 把舊事歸檔到「長期記憶(檔案)」。

cortex 怎麼處理

  • memory:把規則 / 場景知識放檔案、需要時才讀進來(不全塞)
  • 自動壓縮:對話超過容量、系統自動把前面摘要
  • session 切換:你 /clear、開新對話、保留 memory 但清掉 working context
  • handoff 檔:跨 session 重要狀態寫進 current_state_handoff.md
課 09

外掛工具(MCP Server)

讓 AI 接外部服務的方式。

MCP(Model Context Protocol)= 一種標準、讓 AI 接外部工具(Gmail / Telegram / Calendar / Vercel / 自家後台)。安裝 MCP server、AI 就會用該服務的所有功能。

比喻

像給員工各種工具的鑰匙:Telegram 鑰匙、Gmail 鑰匙、Calendar 鑰匙。員工拿到鑰匙就會用、不必每次教他怎麼登入。

cortex 已用的 MCP

  • telegram:發訊息給你 / 草莓 / 黃哥
  • vercel:deploy 網站
  • Gmail / Calendar / Drive:Google 三件套
  • firecrawl:付費 web 搜尋 + scrape
  • playwright / claude-in-chrome:瀏覽器自動化
  • higgsfield:生圖 / 影片
  • computer-use:操作你的 Mac

核心結論

把 AI 養成不嘴答應 = 記憶(為什麼)+ 守門員(強制)+ 任務(追進度)+ 查核(每天檢討)+ 復盤(出 bug 學)5 件套。

記憶 / 規則文字是軟約束(會失效)、守門員是硬約束(真擋)。能寫 hook 就寫 hook、不只寫規則文字。

查核是抓問題、不是治病。真要改要寫 hook。

2026 年 6 月 整理 · 白話中文 9 課
來源:Anthropic Claude Code 官方文件、arxiv 2303.17651 Self-Refine、Shinn et al. 2023 Reflexion、LangChain Reflection Agents、Madaan et al. 2023、openclaw/clawhub、cortex 實證