Codex Skills 如何使用:安装、显式调用与结果验收

安装 Skill 只是把能力放到可发现位置;真正会用还要理解触发条件、提供正确输入,并检查它实际执行了哪些步骤和输出。

直接答案先检查 Skill 的来源、SKILL.md、脚本和权限,再安装到当前 Codex 能发现的个人或项目范围。个人 Skills 的默认目录通常位于 CODEX_HOME/skills(未改 CODEX_HOME 时为 ~/.codex/skills);安装后新建任务,在支持的界面输入 $ 选择 Skill,或用 $skill-name 显式点名。一次给齐文件、链接、参数、输出位置和验收标准,最后核对实际文件、命令、测试或页面结果。

Codex Skills 使用的四个关键动作

前排教程强调目录结构;本站再补上新手最容易漏掉的触发、权限和验收。

1. 安装前检查查看来源、名称、触发描述、引用资料和可能执行的脚本,先判断它是否真的适合当前任务。
2. 选择使用范围只服务一个项目的流程放在项目范围;跨项目重复使用时再考虑个人范围,避免无关任务误触发。
3. 显式调用并给齐输入安装后新建任务,在支持的界面输入 $ 选择,或用 $skill-name 点名;同时写出目标、文件或链接、必要参数、输出位置和停止条件。
4. 用证据验收结果检查它读写了哪些文件、运行了什么命令、输出在哪里、测试或页面是否通过;不能只看一句“已完成”。

适合谁,不适合谁

适合:同一流程反复出现每周报告、批量文件检查、固定格式文章、项目验证或资料整理已经有稳定步骤。
适合:希望训练自己的工作方法你愿意记录失败、补充规则,让流程随着真实使用越来越可靠。
不适合:一次性或经常变化的任务输入、目标和判断方式每次都不同,过早封装只会积累冲突规则。
不适合:无法定义人工责任付款、发布、删除、专业结论或敏感账号操作没有审批与回退时,不应直接自动化。

开始前准备

  1. 一个已经真实执行过的重复任务,以及至少一份成功样例和一份容易出错的样例。
  2. 明确的触发场景、输入材料、输出位置、允许工具和禁止操作。
  3. 记录过人工判断点、常见失败和遇到缺失信息时的停止条件。
  4. 可观察的验收方法,例如数量、格式、关键值、测试、截图或人工抽样。
先有稳定流程,再有 SkillSkill 会重复并放大既有方法。流程还没跑通、规则彼此冲突或验收不可观察时,先继续在项目中试运行,不要急着封装。

完整步骤

01

安装前审查 Skill

打开 SKILL.md 和它引用的脚本、资料,确认来源、触发范围、依赖、联网与文件权限;未知命令先不要执行。

02

确认安装范围和发现路径

个人 Skills 默认放在 CODEX_HOME/skills;项目专用流程按当前客户端支持的项目范围管理。安装后用 Get-ChildItem $env:CODEX_HOME\skills -Directory(PowerShell)或 ls "${CODEX_HOME:-$HOME/.codex}/skills"(macOS/Linux)确认目录和 SKILL.md 存在,再新建任务,避免旧会话没有刷新列表。

03

第一次使用显式点名

在支持的界面输入 $ 选择 Skill,或在任务中写 $skill-name;同时提供目标、输入材料、输出位置和停止条件。

04

先用低风险样例观察执行

查看它读取了哪些文件、运行了哪些命令、是否请求额外权限;涉及发布、删除、付款或外发时停在人工确认前。

05

按证据验收输出

核对生成文件、差异、测试、截图或页面结果,并要求列出未完成项;不能只接受一句“已完成”。

06

记录误触发并持续维护

分别测试正常、缺失、异常和相似但不应触发的输入;如果列表里找不到 Skill,先确认作用域、目录名和新会话;如果文件存在但不触发,改用 $skill-name 显式调用并检查 SKILL.md 的名称与描述,再用固定样例回归。

把每周报告流程整理成 Skill 说明

这不是完整文件模板,而是封装前必须回答清楚的流程规格。

Skill 流程规格
【名称】每周数据与报告检查
【触发】用户要求用本周数据更新固定格式图表和报告时。
【不触发】数据来源不明、生产数据库需要写入、报告模板版本无法确认时。
【输入】本周数据文件、上周报告、当前模板、指标定义表。
【步骤】校验文件 -> 检查字段 -> 生成测试输出 -> 对比关键值 -> 写入报告副本。
【停止条件】缺少必填字段、关键值异常、目标路径不是测试目录。
【验收】文件数量、字段完整率、三项关键值、图表数量和报告页数可核对。
【汇报】列出输入、生成文件、检查结果、异常、未完成项和下一步。
不推荐

以后只要我说做周报,就自动处理所有东西。

建议做法

只有输入、模板和测试目录齐全时才运行;缺少字段或关键值异常立即停止;最终报告必须列出检查证据。

怎样判断结果是否可用?

可用规格能让另一次执行判断何时开始、何时停止、使用哪些材料、输出到哪里以及如何验证;如果这些问题仍需临场猜测,流程还不适合封装。

常见问题与报错

安装后找不到或不触发

先确认个人/项目作用域、目录名和 SKILL.md 位置,并新建会话刷新列表;文件存在但自动触发不稳定时,使用 $skill-name 显式调用,核对名称、描述和输入条件,再用正例、反例和边界任务复测。

Skill 经常在不相关任务里触发

收窄名称和触发描述,补充明确的不触发条件,并用相似但不应触发的任务做测试。

同一输入每次结果差异很大

检查步骤是否依赖未写明的人工判断、动态数据或外部状态;固定输入结构、输出格式和检查规则。

流程跑完了,但错误没有被发现

把数量、关键值、测试或抽样检查设为强制步骤,并规定失败时停止,不继续生成最终成果。

Skill 越改越长、规则互相冲突

删除重复和过期说明,把大段背景移到参考资料;保留单一事实来源,并为更新建立回归样例。

完成后的检查方法

  • 流程真实重复过,至少有成功和失败样例。
  • 触发条件、不触发条件和适用范围明确。
  • 输入、输出、工具、路径、权限和停止条件写清楚。
  • 人工判断、高风险操作和最终责任没有被隐藏。
  • 验收依赖可观察证据,而不是模型自述。
  • 正常、缺失、异常和边界输入都已测试。
  • 版本更新后会用固定样例重新验证。

FAQ

Skill 和普通提示词有什么区别?

普通提示词更适合一次任务;Skill 面向可重复工作,通常还包含触发条件、步骤、参考资料、工具使用和验收方法。具体结构以当前 Codex 官方说明为准。

不会写代码也能做 Skill 吗?

可以先整理不依赖脚本的文件或内容流程。关键是你了解真实步骤、风险和检查方法;需要脚本时再让工具辅助实现并测试。

一个 Skill 应该包含多少任务?

优先只解决一类边界一致的任务。触发条件、输入或验收完全不同的工作应拆开,避免一个 Skill 变成万能说明书。

怎样训练自己的 Skills?

每次真实执行后记录误触发、缺失步骤、失败原因和人工修正,把稳定经验补回说明,并用原有样例做回归测试。

Skill 可以直接执行发布或删除吗?

技术上是否可执行取决于工具和权限,但高影响操作应有明确授权、预览、人工审批、日志和回退,不应默认自动完成。

资料来源与版本说明

从一个已经跑通的小流程开始训练。

先在项目中保存成功与失败样例,完成输入、停止条件和验收规格;需要接入相关客户端时,再到小贺API查看当前配置说明与基础协助。 模型、价格、额度与规则以对应业务站当前展示为准。

进入小贺API查看使用入口

下一步