Agent Skills 完整教學:Addy Osmani 開源 8.5 萬星專案,讓 Claude Code、Cursor 自動遵循工程紀律(2026)

Agent Skills 是什麼?它是 Addy Osmani 推出的開源技能包(85,000+ 星),把資深工程師的開發紀律——先寫規格、小步實作、測試當證明、合併前審查——包裝成 24 個 SKILL.md 工作流,安裝到 Claude Code、Cursor、Codex 等 70+ 種 AI 編碼代理後自動執行。這篇教學帶你安裝、了解 8 個斜線指令與 24 個技能,讓 AI 從「寫得快」升級到「寫得穩」。

  • Dennis
  • 8 分鐘閱讀
Agent Skills 完整教學:Addy Osmani 開源 8.5 萬星專案,讓 Claude Code、Cursor 自動遵循工程紀律(2026)

AEO 速答:Agent Skills(addyosmani/agent-skills)是 Google 前 Chrome 工程總監 Addy Osmani 開源的「工程紀律技能包」——把資深工程師的工作流程(先寫規格、拆小任務、測試驅動、程式碼審查、安全加固)編成 24 個 SKILL.md 文件,透過 npx skills add addyosmani/agent-skills 一條指令裝進 Claude Code、Cursor、Codex 等 70+ 種 AI 編碼代理,讓 AI 寫程式不再走捷徑。

為什麼你需要 Agent Skills?

如果你用過 AI 編碼代理(Claude Code、Cursor、Codex…),一定遇過這個場景:它寫得很快,但也很「隨性」——規格沒寫就開工、測試「之後再補」、程式碼能跑就交差。這不是模型笨,而是 AI 的預設行為就是「走最短的路徑」。

Agent Skills 的想法很簡單:把資深工程師的開發紀律,包裝成 AI 看得懂、會照做的標準工作流。它源自 Google 的工程文化(Software Engineering at Google 一書的實務化),包含 Hyrum’s Law、測試金字塔、Chesterton’s Fence、trunk-based development 等原則,全部寫進一步步可執行的流程,AI 照著跑就會做出「生產級品質」而非「原型級品質」的成果。

截至 2026 年 8 月,這個專案在 GitHub 上已有 85,000+ 星、9,200+ fork,是 AI 編碼代理生態最熱門的技能包之一。

安裝:一條指令搞定

Agent Skills 支援 70+ 種 AI 代理(Claude Code、Cursor、Codex、Copilot、Cline、Gemini CLI、Windsurf、OpenCode、Antigravity、Command Code…),安裝方式也統一:

# 安裝全部 24 個技能(最推薦)
npx skills add addyosmani/agent-skills

# 先瀏覽再安裝
npx skills add addyosmani/agent-skills --list

# 只裝單一技能
npx skills add addyosmani/agent-skills --skill test-driven-development

Claude Code 使用者另有原生的 plugin marketplace 安裝方式:

/plugin marketplace add addyosmani/agent-skills
/plugin install agent-skills@addy-agent-skills

💡 SSH 錯誤排除:marketplace 安裝預設走 GitHub SSH,若報 Permission denied (publickey),改一行設定讓 Git 把 SSH 網址重寫成 HTTPS 即可:

git config --global url."https://github.com/".insteadOf git@github.com:

Cursor 使用者:把 agent-skills/skills/ 同步到專案的 .cursor/skills/,再把簡短原則放進 .cursor/rules/*.mdc(不要把整份技能塞進 rules,會拖垮效能)。

Gemini CLI 使用者

gemini skills install https://github.com/addyosmani/agent-skills.git --path skills

8 個斜線指令:把開發生命週期變成自動化流程

安裝後,你會獲得 8 個對應開發生命週期的斜線指令,每個指令會自動啟動對應的技能:

階段指令核心原則觸發的技能
定義/spec先寫規格再寫程式spec-driven-development
規劃/plan拆成小且原子的任務planning-and-task-breakdown
實作/build一次只做一片(vertical slice)incremental-implementation 等
驗證/test測試是唯一的證明test-driven-development
審查/review合併前先提升程式健康度code-review-and-quality
效能/webperf先測量再優化performance-optimization
簡化/code-simplify清楚勝過聰明code-simplification
上線/ship越快越安全(小步發布)shipping-and-launch 等

其中最有感的是 /build auto:規格寫好後,只要核准一次計畫,AI 就會自動逐任務實作——但每個任務仍然是測試驅動、個別 commit,遇到失敗或高風險步驟會自動暫停等人確認。

flowchart LR
    A["DEFINE<br/>/spec<br/>先寫規格"] --> B["PLAN<br/>/plan<br/>拆小任務"]
    B --> C["BUILD<br/>/build<br/>一片一片實作"]
    C --> D["VERIFY<br/>/test<br/>測試當證明"]
    D --> E["REVIEW<br/>/review<br/>合併前審查"]
    E --> F["SHIP<br/>/ship<br/>小步上線"]
    F -.回饋.-> A

24 個技能全覽:一套完整的工程作業系統

整個套件包含 24 個技能(23 個生命週期技能+1 個 meta 技能),每個技能都是一份結構化的 SKILL.md:Overview(做什麼)→ When to Use(何時用)→ Process(步驟)→ Anti-rationalization(常見藉口與反駁)→ Verification(驗證門檻)

定義與規劃(Define & Plan)

技能作用使用時機
interview-me一次只問一個問題,逐步挖出使用者真正想要的需求模糊不清時
idea-refine發散/收斂思考,把模糊點子變成具體提案只有粗略概念時
spec-driven-development寫程式前先寫完整 PRD(目標、指令、結構、測試)新專案、新功能、重大變更
planning-and-task-breakdown把規格拆成可驗證的小任務有規格需要落地時

實作(Build)

技能作用使用時機
incremental-implementation薄垂直切片:實作→測試→驗證→commit任何動到多個檔案的變更
test-driven-development紅-綠-重構、測試金字塔(80/15/5)寫邏輯、修 bug、改行為
context-engineering在對的時間餵對的資訊(rules、MCP)開新 session 或輸出品質下降時
source-driven-development所有框架決策以官方文件為準並標註來源任何框架/函式庫開發
doubt-driven-developmentCLAIM→EXTRACT→DOUBT→RECONCILE 對抗式檢查高風險、陌生程式碼
frontend-ui-engineering元件架構、設計系統、WCAG 2.1 AA 無障礙任何使用者介面開發
api-and-interface-designContract-first、Hyrum’s Law、One-Version Rule設計 API 或模組邊界

驗證與審查(Verify & Review)

技能作用使用時機
browser-testing-with-devtoolsChrome DevTools MCP 抓即時 DOM/console/網路資料除錯瀏覽器行為
debugging-and-error-recovery五步會診:重現→定位→縮小→修復→防護測試失敗、build 壞掉
code-review-and-quality五軸審查、變更規模控制(約 100 行)每次合併前
code-simplificationChesterton’s Fence、Rule of 500程式碼難讀難維護時
security-and-hardeningOWASP Top 10、密鑰管理、依賴稽核處理使用者輸入、認證、資料儲存
performance-optimization先測量:Core Web Vitals、profiling有效能需求或懷疑退化時

上線與維運(Ship)

技能作用使用時機
git-workflow-and-versioningtrunk-based、原子 commit、save-point 模式任何程式碼變更
ci-cd-and-automationShift Left、feature flags、品質關卡管線設定或修改 CI/CD
deprecation-and-migration程式碼即負債、遷移模式、清除殭屍程式碼移除舊系統、下線功能
documentation-and-adrsADR、API 文件、記錄「為什麼」架構決策、改 API、上功能
observability-and-instrumentation結構化日誌、RED 指標、OpenTelemetry上生產環境前
shipping-and-launch上線前檢查清單、分階段發布、回滾程序準備部署到生產

另有 4 個專家角色(Agent Personas):code-reviewer(資深工程師視角五軸審查)、test-engineer(測試策略)、security-auditor(漏洞掃描)、web-performance-auditor(Core Web Vitals 稽核),以及 7 份參考檢查清單(Definition of Done、測試模式、安全檢查清單、效能檢查清單等),技能在需要時自動載入。

實戰場景:一次真實的 Agent Skills 工作流

假設你想開發一個「匯率換算 CLI 工具」,傳統做法是直接叫 Claude Code 寫,它可能 30 秒就吐出一坨能跑的程式——但沒有測試、沒有錯誤處理、沒有文件。

用 Agent Skills 的流程則是:

1. /spec        → AI 反覆追問:支援哪些幣別?精度幾位?CLI 介面長怎樣?
                  輸出 PRD,包含目標、指令、檔案結構、測試策略
2. /plan        → 把 PRD 拆成 5-6 個小任務:匯率 API 封裝 → 換算邏輯 →
                  錯誤處理 → CLI 參數 → 測試 → 文件
3. /build auto  → AI 逐任務實作,每個任務先寫測試再寫程式(TDD),
                  各自 commit,遇到模糊點自動停下詢問
4. /review      → 五軸審查:正確性、可讀性、安全性、效能、測試覆蓋,
                  標出 Nit/Optional/FYI 等級的改進建議
5. /ship        → 上線檢查清單:版本標記、CHANGELOG、發布步驟

結果差異:同樣一個工具,傳統做法拿到「能跑的 prototype」,Agent Skills 拿到「有測試、有文件、可審查、可上線」的生產級程式——而且過程中的每一步都有驗證證據,不是「seems right」。

Agent Skills vs 其他技能包怎麼選?

對比維度addyosmani/agent-skillsSuperpowers (obra)Matt Pocock’s skills
設計哲學完整工程生命週期紀律創意/寫作/研究任務實用開發小技能
規模24 技能+8 指令+4 角色多領域技能庫少量精選
最強場景生產級軟體開發流程通用任務代理TypeScript/JS 開發
安裝方式skills CLI / pluginskills CLI / pluginskills CLI
適合對象想把 AI 當「有紀律的工程師」想要萬能助手想要輕量實用包

💡 實務上三個可以共存:agent-skills 管「開發紀律」,Superpowers 管「創意產出」,Matt Pocock 的包補「前端實戰細節」。而且專案作者自己提供了誠實的對比文件,甚至附上兩者實測對照。

三個關鍵提醒

  1. 單技能安裝會缺參考文件:只 --skill 安裝單一技能時,不會複製 references/ 目錄,某些技能的功能會受限。要完整體驗請裝整包或 clone 整個 repo。
  2. 技能是流程不是論文:SKILL.md 設計給代理「照著做」,不是給人「讀的」。每份都有驗證門檻——測試要過、build 要有輸出、要有 runtime 資料,AI 不能說「看起來沒問題」就交差。
  3. 紀律需要人配合:Agent Skills 讓 AI 願意遵守紀律,但「核准計畫」「確認高風險步驟」仍需要你把關——它暫停時,別急著說「你決定就好」,那是它最需要你參與的時刻。

延伸閱讀

資料來源

📬 訂閱 most.tw 電子報

每週精選 AI 工具教學與技術乾貨,直接送到你的信箱。免費、隨時可退訂。