团队内部学习 · Claude Code 技能体系

把反复说的话
存成一个斜杠命令

从分享会笔记出发,补齐到 2026 年 7 月的现状:技能怎么存、怎么触发、官方生态装了什么、我们这台机器上实际在跑哪些

// 面向团队所有同学 · 不需要会写代码也能读完前四节

CLAUDE CODE 2.1.215 SKILLS · SUBAGENTS HOOKS · MCP PLUGIN MARKETPLACE GIT WORKTREE 并行 EVALS · LLM-AS-JUDGE
SCROLL / 向下滚动
01
Mental Model

一句话说清这是什么

Claude Code 是 Anthropic 官方的命令行编程助手。它真正的威力不在「会写代码」,而在你可以把一整套做事流程存成一个按钮——敲一个 /名字,一段几百字的指令自动展开,Claude 照着流程走。

Core Idea

技能(Skill)= 把你反复要说的一长段指令,存成一个 /名字它不是黑魔法——就是一个文本文件,里面用大白话写「被触发时你该按什么步骤做事」。看得懂中文就能写。

但到 2026 年,「技能」只是扩展 Claude Code 的五层之一。先把这张地图记住,后面所有名词都能各就各位。

📄

LAYER 1 · SKILL技能 / 斜杠命令

一个 Markdown 文件 = 一套流程。主动敲 /名字 触发,或让 Claude 自己判断该不该用。绝大多数人只需要用好这一层。

.claude/skills/名字/SKILL.md
🧑‍🚀

LAYER 2 · SUBAGENT子智能体

派一个独立上下文的分身去干活,干完只回报结论。适合"搜一大堆文件""并行审多个模块"——脏活不占主对话的上下文。

.claude/agents/名字.md
🪝

LAYER 3 · HOOK钩子

在工具调用前后强制跑一段脚本。技能是"建议 Claude 这么做",钩子是"不这么做就不许过"——规则不会被忘。

settings.json · hooks
🔌

LAYER 4 · MCP外部工具接口

让 Claude 能真的调用外部系统:飞书、GitHub、Figma、Playwright、数据库。技能负责"怎么做",MCP 负责"能碰到什么"。

.mcp.json · claude mcp add
📦

LAYER 5 · PLUGIN插件与市场

把上面四样打包成一个可安装单元,从插件市场一条命令装进来。这是 2026 年最大的变化——不用再手抄别人的技能文件。

/plugin · marketplace
🧠

CROSS-CUTTING · MEMORYCLAUDE.md

不是技能,但决定一切:项目根目录的 CLAUDE.md每次对话都会自动加载的长期规则。团队规范写在这里,比反复口头叮嘱有效得多。

项目根 / ~/.claude/CLAUDE.md
02
The Three Fundamentals

新手必懂的三件事

在认识具体技能之前,把底层机制搞清楚,后面就都通了。

01 / 它们存在哪里两种写法,已合并

一个技能就是一个文本文件

放在约定好的文件夹下,Claude 启动时自动扫描。两种写法都还能用,触发出来的效果完全一样

老写法 · Slash Command

  • .claude/commands/名字.md
  • 一个 .md 就是一个 /名字
  • 只能主动敲命令触发
  • 仍然有效,适合极简的一次性命令

现在推荐 · Skill

  • .claude/skills/名字/SKILL.md
  • 一个文件夹配一个说明文件
  • 可主动敲,也可让 Claude 自己判断要不要用
  • 文件夹里能放脚本、模板、参考文件(渐进式加载,不撑爆上下文)

文件开头的 frontmatter 决定它怎么被发现:name 是命令名,description 是"什么时候该用我"——这句写得好不好,直接决定 Claude 会不会在对的时机自动想起它。

02 / 怎么触发主动 + 自动

敲命令,或者让它自己想起来

主动触发:对话框里输入 /名字 回车。自动触发:技能的 description 写清适用场景后,Claude 遇到相关任务会自己调用,你不用记名字。

作用域三层,同名时更具体的优先:项目级 .claude/(跟着 git 仓库走,全团队共享)> 用户级 ~/.claude/(你这台机器所有项目通用)> 插件带来的。

# 看当前会话能用哪些技能、哪些插件
/help
# 看上下文还剩多少、被谁占了
/context
03 / 思考档位⚠️ 这条已经变了

调思考深度:现在靠 /effort,不靠魔法词

如果你读过早期教程,大概记得「thinkmegathinkultrathink 三档油门」。这个说法现在已经过时了——官方文档原文写得很清楚:

官方原文 · code.claude.com/docs/en/model-config

"Include ultrathink anywhere in your prompt to request deeper reasoning on that turn… Other phrases such as "think", "think hard", and "think more" are passed through as ordinary prompt text and are not recognized as keywords."

翻译成人话:ultrathink 还有用,但它只是往对话里插一句"请想深一点"的指令,并不改变真正发给模型的思考预算。而 think / think hard / megathink 已经完全失效,写了等于白写——纯粹浪费 token。

真正控制思考深度的是 effort(努力档位),六档,用 /effort 调:

档位什么时候用备注
low短、范围明确、要求快的活不吃智力的任务
medium省钱优先,可以牺牲一点智力
high平衡档 —— Fable 5 / Sonnet 5 / Opus 4.8 的默认默认
xhigh更深的推理,token 花得更多Opus 4.7 的默认
max难题可能有提升,但容易想过头,收益递减仅当前会话
ultracode每个实质任务自动编排一套多智能体工作流仅当前会话

怎么设:/effort(不带参数开滑杆)· --effort 启动参数 · effortLevel 设置项 · 或写进某个技能的 frontmatter effort: xhigh(只在这个技能运行时生效)。

团队行动项

去把我们各处 prompt 模板、CLAUDE.md、技能文件里残留的 think hard / megathink 全部删掉——它们现在只是普通文字。要深思就用 /effort xhigh,或在技能里写 effort: xhigh

03
Skill by Skill

常用技能逐个拆解

按「什么时候用」排序,不按名字。下面这些在我们这台机器上都实测可用——直接敲就有。

想清楚
需求
/grill-me(= /grilling)——像面试官一样一次只问一个问题,一路追问到把想法逼成清晰需求。关键规则:全程别清空对话、别开新窗口,它问出来的上下文正是下一步写文档的原料。
对齐
方案
/brainstorming(superpowers 插件)——动代码前先对齐设计意图。团队规范里写死了:新 feature / 设计组件 / 重构方案,先 brainstorming 再动手。
查资料
选型
/deep-research —— 多轮搜索、抓多个来源、交叉核对,最后给带出处的结论。技术选型、了解陌生领域时用,比随口问一句可信得多。
遇到
Bug
/systematic-debugging —— 强制先定位根因再改,不许直接猜着打补丁。配上一句高质量提问效果更好(见下方彩蛋)。
写完
自检
/code-review 找 bug + /simplify 做精简。两者分工明确:simplify 只管清晰度/复用/效率,不找 bug;要抓 bug 必须走 code-review。
交付前
验证
/verification-before-completion —— 宣称"做完了/修好了"之前,必须真的跑一遍验证命令并贴出输出。先有证据,再有结论。

// 真正的威力在按顺序串起来:想清楚 → 查资料 → 写文档 → 拆任务写代码 → 收尾整理。工具再多,本质只有一句——把脑子里的流程拆成一个个可复用的按钮。

彩蛋 · 高质量提问模板

分享会里最值钱的一张截图,其实没用任何命令

「请分析这个 bug 的根因,并给出一个架构层面更稳健、能从根本上规避边界问题的重构方案,而不是局部打补丁。」

它要求先找根因、再从架构层给方案,并明确否掉了偷懒解法。你把标准提高,AI 的产出就跟着提高——这是整套方法的精髓,比任何命令都重要。

04
What Changed Since the Talk

从那次分享会到现在

分享会笔记里的方法论今天依然成立,但获取方式变了:当时要手抄别人的技能文件,现在官方插件市场一条命令装好。

老教程里的说法2026-07 的现状怎么办
斜杠命令和技能是两套东西官方原文:"Custom commands have been merged into skills." 同名时技能优先,旧的 .claude/commands/ 仍向后兼容新写的一律放 skills/
think / megathink / ultrathink 三档只剩 ultrathink 有效,且只注入一句指令、不改 API 思考预算;其余当普通文字改用 /effort
技能要去 GitHub 手抄文件官方插件市场已内置/plugin 浏览安装;superpowers 等主流合集都已进官方市场/plugin 再考虑外部
worktree 要自己敲 git 命令一等公民claude --worktree <名字>,甚至 --worktree "#1234" 直接从 PR 切;桌面版每个新会话自动带一个-w 而不是手搓
子智能体是前台跑的默认后台运行,还能再派生子智能体(最深 5 层);claude agents 一屏看所有会话放心并行派
多开会话要靠第三方工具官方内置 Agent Teams(实验性,默认关闭)、后台会话、/tasks/resume先看官方有没有
改输出风格用 /output-style该命令已移除(v2.1.91)改用 /config
用 /agents 向导建子智能体交互式向导已移除(v2.1.198),改为直接编辑文件手写 .claude/agents/*.md
——(当时还没有)检查点与 /rewind:每条 prompt 自动存档,保留最近 100 个,可回到 /clear 之前大胆试激进方案
——(当时还没有)/context 可视化上下文占用 · /doctor 全面体检 · /usage 按技能拆解额度对话变笨时先 /context
最需要记住的一条

官方把最佳实践归结成一句根本约束:"Claude 的上下文窗口填得很快,而且越满表现越差。"——技能、子智能体、/clear、检查点、MCP 的延迟加载,全部是这一条的推论。理解了这句,剩下的都是细节。

🧹

官方给的删减判据CLAUDE.md 别写太长

对每一行问一句:「删掉它会让 Claude 犯错吗?」答否就删。官方警告原文:臃肿的 CLAUDE.md 会导致 Claude 忽略你真正的指令。建议每个文件控制在 200 行以内。

诊断法:规则写了却总不遵守 → 文件太长,规则被淹没了;不是写得不够狠。

🔁

两次纠正法则什么时候该 /clear

官方原话:同一个问题在一次会话里纠正超过两次,说明上下文已经被失败的尝试塞满了。这时候正确动作不是继续解释,而是 /clear 重开 + 写一个更好的开场 prompt。

/clear任务之间的默认动作,不是最后手段。

05
Open-Source Ecosystem

生态地图 · 该从哪装

先装官方市场里的,不够用再去 GitHub 找第三方。顺序别搞反——官方市场里已经有的东西,去外面找一个维护更差的版本是纯亏。

🏛️

第一站 · 官方市场claude-plugins-official

Anthropic 托管的插件目录,已内置——直接敲 /plugin 就能浏览安装,不用加任何地址。收录 39 个官方插件 + 15 个外部插件。

/plugin
📚

官方 SKILLSanthropics/skills

官方技能仓库,含 docx / pdf / pptx / xlsx 的生产级实现,以及 Agent Skills 的规范文档。想学「一个好技能长什么样」,读这个。

/plugin marketplace add anthropics/skills
🦸

方法论骨架obra/superpowers

生态第一大仓,已收进官方市场。不是技能堆砌,而是一整套开发方法论:逼问出 spec → 出计划 → 真 red/green TDD → 子智能体驱动执行。我们装的就是这个。

/plugin install superpowers@claude-plugins-official
🔥

工程日常mattpocock/skills

分享会里 grill-me 的娘家。现在已演化成三件套:grill-me(入口)、grilling(真逻辑)、grill-with-docs(带文档版)。

npx skills@latest add mattpocock/skills
🗺️

总索引awesome-claude-code

社区事实标准入口,skills / hooks / commands / 编排器 / 插件全覆盖。不知道有没有现成轮子时,先来这里搜一遍。

hesreallyhim/awesome-claude-code
💰

成本与用量ccusage · claude-hud

npx ccusage@latest 免安装算 token 和花费;claude-hud 在会话里实时显示上下文占用、活跃工具、运行中的子智能体。

npx ccusage@latest
选型红线 · 两条

① star 数在 2026 年已经是弱信号。我们实测到十几万 star 但三个月没人动的仓库。判断该不该用,看最后一次提交时间有没有组织背书(anthropics / trailofbits / microsoft / hashicorp),别看星。

② 装插件 = 授予在你机器上执行命令的权限。插件会带 hooks 和可执行脚本。优先官方与经审核的市场(Trail of Bits 的 skills-curated 是安全团队人工审过的),那种「一次给你 425 个插件」的大杂烩仓库要谨慎。

已经不用找了

第三方「多 session 编排器」这个品类正在被官方能力吃掉——Agent Teams(多会话自动协调、共享任务、消息传递)、worktrees桌面端并行会话都已内置。同理,纯 .md 堆砌的 subagent 合集仓库基本全停更了,活下来的都重构成了插件市场。选型前先看官方有没有。

06
Parallelism & Isolation

让多个 AI 同时干活还不打架

一个 Claude 写新功能、另一个修 bug,两边改的文件必须互不干扰。这靠两件事解决:工作区隔离(worktree)和上下文隔离(subagent)。

🌿

WORKSPACE ISOLATIONgit worktree

Git 的原生能力:从同一个仓库拆出多个互相独立的工作目录,各有各的分支和文件,但共享同一套提交历史。一个目录一个 Claude,谁也覆盖不了谁。

我们团队的规矩:feature 级任务必开(新功能 / 重构 / 多文件改动);单文件小 fix、配置微调、纯问答不开——开了反而是负担。

分支名 feat-<slug> / fix-<slug>
🧑‍🚀

CONTEXT ISOLATION子智能体并行

子智能体有自己独立的上下文窗口。让它去翻 50 个文件,翻完只回一句结论——主对话的上下文完全不被污染。

团队规矩:≥2 个互不依赖的任务,必须在同一条消息里派多个 agent,而不是发 N 轮。搜索/分析类超过 3 次查询也应该交给 agent,不要串行 grep。

同一条消息 → N 个 agent 并发
Why it matters

这两件事解决的是同一个根问题的两面:worktree 防止文件互相覆盖,subagent 防止上下文互相污染。少了任何一个,"并行"都会变成"互相拖累"。

07
Evals & Agent Loops

怎么知道 AI 干得好不好

AI 写出来的东西,靠人一条条看太慢也太贵。这一节是进阶话题——新手知道有这回事、大概是什么就够了,用到时再深入。

⚖️

EVALS评估:把「好不好」变成数字

一套系统性给 AI 输出打分的方法,让你能客观看出这次改动是变好还是变差。想让 AI 稳定变好,前提是先能量化它到底好不好。

👨‍⚖️

LLM-AS-A-JUDGE让另一个 AI 当判卷老师

最省事的打分法:给它「原问题 + AI 的回答 + 评分标准」,输出一个分数或 yes/no。快(几小时评上千条)、便宜、可规模化。

🔁

LOOP AGENT智能体循环

不是一次性吐出答案,而是「执行一步 → 看结果 → 决定下一步」转圈直到完成。Claude Code 本身就是这么跑的。

🧪

GENERATE → JUDGE → REFINE自我迭代

把上面三样接起来:生成 → 裁判打分 → 按反馈改进 → 再来一轮。让 AI 在循环里越做越好,而不是一锤子买卖。

现实提醒

自动裁判不能替代人工验收,只能替代"人工逐条初筛"。我们团队踩过的坑写进了规范:任何 audit / review / 子 agent 报出的问题,必须自己 grep 验证存在性再采信——AI 报的假阳性比漏报更损伤信任。

08
Our Actual Setup

我们这台机器上实际装了什么

上面讲的都是概念,这一节是实测清单——2026-07-20 从本机配置直接盘出来的,不是转述文档。

Runtime◈ CLI

Claude Code 2.1.215

claude --version

插件全部来自官方市场 anthropics/claude-plugins-official——没有一个是从野生仓库手抄进来的,升级和安全性有人兜底。

已装 23 个插件 · 市场收录 39 官方 + 15 外部
Skills✦ 自建

32 个用户级技能

~/.claude/skills/

绝大多数是我们自己写的业务技能:飞书全家桶(doc / base / sheets / wiki / im / task…)、企微套件、finance-report 财务周报、canary 部署回归、dark-tech-page(这一页就是它生成的)。

lark-* 15 个 · wecomcli-* 7 个 · 自研 10 个
Guardrails⚑ Hooks

钩子 · 强制门禁

~/.claude/settings.json

Bash / Read 调用前跑 danger-guard.sh 拦危险操作,push 前提醒,会话开始与结束自动清理残留 worktree。这些不是建议,是必过的关。

PreToolUse · SessionStart/End · PostToolUse
🧑‍🚀

CUSTOM SUBAGENTS两个自建子智能体

conversation-wrap-up——收尾时归档经验、更新记忆库;lark-card-reviewer——推送前审查飞书卡片结构合规性。都是把「每次都要检查一遍」的事固化成了分身。

🔌

MCP SERVERS接出去的外部系统

用户级 browser-use / yingdao-rpa,项目级 lark / github / airwallex / meta-ads / notebooklm,再加插件自带的 Playwright、Figma、Supabase、Context7。

最值得抄的一条

我们把团队规矩全写进了全局 CLAUDE.md:回复语言、CI/CD 与部署验证纪律、飞书卡片格式、验证前置分档、worktree 隔离规则、提交信息规范。与其每次口头叮嘱,不如写一次让它每轮都读到。这是投入产出比最高的一步——比装任何插件都管用。

09
Getting Started

想自己上手?三步就够

STEP 01约 10 分钟

装 Claude Code

Anthropic 官方命令行工具,按官方文档安装即可(需要账号)。新同学完整开荒动线见团队另一篇 《新 Mac 开荒手册》

claude --version   # 装好后先验一下
STEP 02约 2 分钟

装现成技能,别从零写

在对话里敲 /plugin 打开插件市场,浏览 → 安装。先把官方市场逛一遍,你想要的多半已经有了。

/plugin            # 浏览并安装插件
/help              # 装完看看多了哪些命令
STEP 03约 5 分钟

造一个自己的

新建 .claude/skills/我的命令/SKILL.md,用大白话写清「被触发时你要一步步做什么」,保存后就能 /我的命令 调用。不确定怎么写就用 /skill-creator 让 Claude 帮你写。

mkdir -p .claude/skills/my-command
cat > .claude/skills/my-command/SKILL.md <<'EOF'
---
name: my-command
description: 什么时候该用我 —— 这句决定 Claude 会不会自动想起它
---

被触发时,请按以下步骤做事:
1. ……
2. ……
EOF
新手最省事的起点

先只装并用熟 /grill-me 一个。把一个想法丢给它、认真回答它的每个问题,你会立刻感受到「被问清楚」的价值——这是整套方法里性价比最高的一步。

10
Cheat Sheet

一页速查表

存到书签栏。左边是敲什么,中间是干什么用,右边是什么时候该想起它

敲什么干什么用什么时候
/effort调思考深度(low→max 六档,这才是真的油门架构决策 · 陌生代码归因
ultrathink单轮请求想深一点(写在提问里的词。think / megathink 已失效这一轮特别难时
/grill-me像面试官一样反复追问,帮你把需求想透写 PRD / 动手写代码之前
/brainstorming动代码前对齐设计意图新 feature · 重构方案
/deep-research多来源深度调研并给出处技术选型 · 陌生领域
/systematic-debugging强制先定位根因再改遇到 bug / 测试挂了
/code-review找 bug、安全问题、逻辑错误提 PR 前
/simplify精简改动过的代码(只管清晰度,不找 bug)一轮开发做完后
/verification-before-completion宣称"做完了"之前先跑验证并贴证据交付 / 合并之前
/context看上下文还剩多少、被谁占了对话变慢 / 变笨时
/clear清空上下文重开换任务时 · 同一问题纠正超两次
/rewind(Esc Esc)回到任意一条 prompt 之前的检查点方案跑歪了想回退
/doctor体检:装配问题、没用的技能、慢 hook感觉哪里不对劲时
claude -w <名字>开一个隔离的 worktree 工作区开始一个 feature 之前
/plugin浏览并安装官方插件市场想要新能力时的第一站
/skill-creator让 Claude 帮你写一个新技能想造自己的命令时
git worktree多个 AI 并行开发不冲突同时开发功能 + 修 bug
并行 subagent独立上下文的分身干脏活≥2 个互不依赖的任务
CLAUDE.md每次对话自动加载的长期团队规则同一句话叮嘱超过两次时
「先找根因,架构级重构,别打补丁」高质量提问模板(非命令)任何时候想提高产出标准
Sources & Evidence

信息来源与证据档位

  • A · 官方文档实抓code.claude.com/docs 的 skills / model-config / worktrees / memory / checkpointing / best-practices 各页。ultrathink 与 think/megathink 的判定为原文逐字引用。
  • A · 本机实测:第 08 节全部数据来自 2026-07-20 本机配置直接盘点(claude --version、已装插件清单、settings.json、MCP 配置),非转述。
  • A · GitHub API 实测:第 05 节各仓库的活跃度与归属经 gh api 独立核验,未采信二手博客数字(调研中发现多篇 SEO 博客的 star 数与实测严重不符)。
  • 底稿:团队内部分享会笔记《玩转 Claude Code 的自定义技能 / 斜杠命令》。其方法论部分仍然成立,但「三档思考关键词」一节已被官方文档推翻,本页已更正
  • 未核实项:star 数不代表真实使用量,2026 年该指标已被证明是弱信号;选型请以最后提交时间与组织背书为准。
一句话总括:Claude Code 的上限不由模型决定,而由你把流程沉淀成了多少个按钮决定。先用熟 /grill-me,再把团队规矩写进 CLAUDE.md,最后才是造自己的技能——顺序反了会很累。