-
2026 年 01 月 29 日在 AI 代理(Agent)發展的早期,開發者總是試圖讓模型變得「無所不能」。我們塞給它長達數千行的 System Prompt,或是串接幾十個 API 工具。然而,這種做法很快就遇到了瓶頸:模型開始變得混亂、指令遵循度下降,且 Token 成本居高不下。Agent Skill 機制因此應運而生。
簡單來說,Agent Skill 是一種封裝好的、模組化的能力包。它不單純只是一個「功能(Function)」,而是一個包含特定指令(Instructions)、專業知識(References)與自動化腳本(Scripts)的完整單元。
如果把大模型比喻成一個具備極高智商但不具備專業經驗的「社會新鮮人」,那麼:
隨著 Claude 與 OpenAI 相繼推出標準化的技能規格,我們可以看到這項技術正成為 AI 應用的核心,主要源於以下四個痛點的突破:
目前的模型雖然上下文視窗越來越大,但隨之而來的是「資訊迷失(Lost in the middle)」的問題。將所有專業指令都塞在系統提示詞中,會導致模型反應遲鈍且精準度下降。
解決方案:Skill 機制採用 「漸進式揭露(Progressive Disclosure)」。只有當 Agent 識別出任務需求時,才會動態載入該技能的完整指令。這讓 Agent 保持輕巧,同時在關鍵時刻具備深度。
通用的模型往往只能給出中規中矩的回答。但在專業應用(如程式碼審查、法律分析)中,需要的是極度精確的作業規範。
解決方案:Skill 允許開發者定義嚴格的
SKILL.md,引導 Agent 在特定場景下遵循專業的邏輯鏈條,從而大幅提升輸出的品質與專業度。
給予 Agent 永久的 Bash 權限或檔案寫入權限是非常危險的。
解決方案:透過 Skill 的 執行上下文修改(Execution Context Modification),權限可以被限制在技能啟動的當下。例如:只有在「部署專案技能」被啟動時,Agent 才能獲得執行伺服器指令的權限,任務結束即收回。
OpenAI 與 Claude 在 SKILL.md 的格式上展現了高度共識,這意味著:
npm 的 Skill Hub,開發者可以直接下載「專業會計技能」或「資安稽核技能」裝載到自己的系統中。當我們深入剖析 Han Lee 對 Claude 的底層拆解以及 OpenAI Codex PR #7412 的程式碼變動時,我們會發現兩家巨頭正試圖解決同一個問題:如何在不讓系統提示詞(System Prompt)爆炸的前提下,賦予 Agent 專家級的處理能力。
以下是針對兩者實作細節的深度強化比對:
這是兩者在「如何啟動技能」上的根本差異。
Claude 的「元工具(Meta-tool)」派發: Claude 實作了一個名為 Skill(大寫 S)的虛擬工具。系統會將所有可用技能的名稱與簡短描述,動態地塞進這個 Skill 工具的 description 中。這裡沒有傳統的關鍵字比對或向量搜尋。系統是直接利用 LLM 的推理能力,讓 Claude 自己從工具清單中判斷:「現在的情況適合調用 pdf 技能」。這是一種推理驅動的觸發方式。
OpenAI 的「套件管理」模式: OpenAI 在 PR #7412 中展現了更接近開發者習慣的作法。他們引入了 $skill-installer 的概念,類似於 npm install。OpenAI 傾向於讓技能成為系統環境的一部分。透過明確的安裝機制,將技能與 MCP(模型上下文協定)連結。這讓技能的啟動更具預測性,且更容易在不同的 CLI 環境中進行靜態管理。
如何讓 Agent 讀取五千字的「技能說明」,卻又不讓用戶的聊天視窗被洗版?
isMeta: true 隱藏層: 根據 Han Lee 的拆解,Claude 在啟用技能時會發送兩條 User 訊息:
標籤,顯示給用戶看(例如:「正在載入 PDF 處理技能」)。isMeta: true。這條訊息包含完整的 SKILL.md 指令內容。它會被送往 API 讓模型閱讀,但在用戶端會被前端完全過濾掉。這解決了「專業指令冗長」與「介面簡潔」之間的衝突。這是實作中最高階的部分:Agent 在使用技能時,它的「權限」會改變嗎?
Skill 工具會回傳一個 contextModifier。這個修改器會暫時改變 Agent 的運作參數。例如,原本禁用的 Bash 工具,在執行 code-review 技能期間,會被暫時允許調用特定目錄下的腳本。任務一旦結束,權限即刻收回。這落實了權限最小化的安全原則。當技能更新後,如何確保 Agent 不會變笨?
Purpose, Instructions, Error Handling 段落)來約束模型行為。它信任模型的強大理解力。evals/ 測試框架。 OpenAI 的 PR 中最醒目的細節在於強制性或建議性的測試目錄。他們提倡為每個技能撰寫評測腳本(輕量級端到端測試)。當開發者修改了技能提示詞,系統會自動跑過一遍測試案例,驗證 Agent 的輸出 JSON 或行為是否依然符合預期。這是將 AI 開發軟體工程化的極致展現。這兩家公司雖然都採用 SKILL.md 作為標準規範,但其系統架構的「核心驅動方式」有顯著差異。以下為你將兩者的運作邏輯做詳細說明。
Claude 的設計核心在於「元工具(Meta-tool)」機制。它將所有的技能視為一個巨大的工具箱,並透過對話過程中的推理來決定加載哪一個專家模組。
Skill 的工具。其描述(Description)會動態生成一份所有可用技能的簡短清單。Skill 工具(例如:command: "pdf")。SKILL.md 指令注入對話。OpenAI 的設計更強調「生命週期管理(Lifecycle Management)」。它將技能視為可以被安裝、管理且必須通過自動化測試的軟體包。
scripts/、references/ 目錄執行確定性任務。evals/ 目錄中的自動化測試案例,確保指令變更後行為依然正確。| 技術維度 | Claude (Anthropic Style) | OpenAI (Codex Style) |
| 分配者架構 | 透過 Skill 元工具動態分配 |
透過 installer 進行靜態安裝 |
| 訊息注入 | 雙訊息機制 (isMeta 隱藏層) |
系統提示詞動態組裝 |
| 環境控制 | 執行時動態修改權限 (Runtime Modifier) | 預定義的沙盒與 MCP 節點 |
| 維護重點 | Markdown 指令的細膩度與引導 | 自動化評測架構 (evals/) 的嚴謹度 |
| 跨平台標準 | SKILL.md 規格發起者 |
agentskills.io 規格推動者 |
參考資料:
筆電就能跑:Google Gemma 4 12B 登場,效能直追 26B 模型
AI駕馭 Claude Code 的百萬 Token。5 招提升 AI 程式設計效率
AI 服務紅利期進入尾聲:運算成本飆升,Claude、Google、X.AI 陸續收緊使用限制
AI國際AI工具進台灣卡在發票 歐買尬出手
AI國際AI工具進台灣卡在發票 歐買尬出手
AIAI 變身最強駭客?Anthropic 發表未公開模型 Claude Mythos,找到 27 年未被發現的漏洞
AIAnthropic 攜手 Google、博通豪砸 3.5 GW 算力佈局 AI 算力
AI影片生成「白菜價」時代來臨!Google 推 Veo 3.1 Lite 影片生成模型,每秒只要 0.05 美元
AIClaude Code 原始碼外洩,究竟 Anthropic 是如何實現 Harness,讓 coding agent 可以穩定長時間運作?
AI別只寫 Prompt!先工程化你的 AI 協作系統
手哥 HANDBRO 硬是要學共同創辦人兼職打雜編輯,熱愛網路、熱愛 3C!腦袋是個不定時炸彈,隨時會炸出新玩意兒!如有開箱、評測或各種合作需求,請洽:contact@soft4fun.net。 YouTube 頻道:手哥科科 《手哥科科》YouTube 頻道 從電視的大螢幕到手機的小螢幕,要維持一致的顯示色彩也是不容易的事情,三星這個 Demo 讓大家知道它們做得到 #computex2026 00:22 HKC 在 #Computex 上推出的全球首款 83.4 吋 12K 超寬曲面螢幕,這款螢幕的寬度寬到兩邊都還要用支撐架來輔助穩定。但這個體驗真的相當讚,臨場感滿分。 00:19 不用一直盯小孩!SpotCam BabyCam Pro 實測:AI 偵測、5 吋螢幕、24 小時雲端錄影一次看 12:36 過年春節拍照手機空間不夠? 用這招讓你不會錯失任何一個珍貴畫面!#pCloud 春節42折優惠 03:56 比架 NAS 還划算!pCloud 雲端硬碟,付一次費終身使用!雙11限定38折! 05:58在我的瀏覽器中保存我的姓名,電子郵件和網站,以便下次評論。
新文章使用電子郵件通知我。