技能包(Skills)
技能包是面向固定运维场景的标准化 AI 能力:您说明要什么检查或什么任务,AI 按技能规范执行并输出报告,减少每次从零写 prompt。
控制台入口:监控与运维 → 技能管理。导入后可挂到智能体,也可在 AI 巡检里按实例绑定。
解决的问题
- 巡检 checklist 靠人记,不同人执行标准不一致。
- 等保、网络设备、K8s 负载等专项工作步骤多,容易漏项。
- 希望 AI 输出结构化报告,而不是零散对话。
平台能做什么
- 在控制台浏览、管理已安装技能(可导入、可版本化)。
- 在 AI 对话中触发对应技能(通常需绑定正确实例类型,如 Linux 主机、MySQL、K8s 集群)。
- 技能执行以只读或低风险为主,写操作仍受平台审批策略约束。
- 凭证与对话隔离:数据库 / SSH / Kube 密码不进入对话明文,由平台运行时注入。
- 输出 Markdown / HTML 等形式报告,便于存档与分享。
技能类型
创建技能时需选择类型(创建后不可改)。类型决定上传形态与运行时工具,请勿选错:选成「纯文档」则脚本不会被注册。
| 类型 | 上传 | 运行时 | 示例 |
|---|---|---|---|
纯文档(doc) | 单个 .md(≤ 512KB) | 仅 read_skill 读全文,再配合平台内置工具 | 等保测评、排障手册 |
脚本包(package) | .zip(≤ 50MB,须含 scripts/) | 先 read_skill,再 run_skill_script 跑白名单入口 | Linux 巡检、MySQL 巡检、K8s 负载 |
脚本包内部再按 platform.json 的 credential_mode 区分凭证注入方式(CLI 传参 / SSH 环境变量 / kubeconfig),见下文。
SKILL 规范 v1
兼容常见 Agent Skill 的 SKILL.md 形态;脚本包用 platform.json 对接平台凭证与执行层。官网常见的 _meta.json 不会被读取,请勿依赖。
SKILL.md(两种类型都要)
文件开头用 --- 包裹 YAML frontmatter。Agent 只按 description 做场景匹配,执行前必须 read_skill 读全文,禁止凭摘要臆测步骤。
| 字段 | 要求 |
|---|---|
name | 必填。小写 slug,^[a-z0-9-]{1,64}$ |
description | 必填。写清何时必须使用本技能(触发条件) |
skill_type | 必填。doc 或 package |
version | 建议。如 1.0.0 |
instance_type | 建议。none / linux / db / k8s / network / multi |
risk_level | 建议。low / medium / high |
正文建议包含:何时使用、问题定义、诊断路径、推荐方案、验证方法、执行规则。脚本包还需写清入口脚本与 run_skill_script 的 entry / action。
纯文档示例:
---
name: redis-memory-oom-playbook
description: >
当 Redis 内存打满、OOM 或 evicted_keys 飙升时使用。
version: "1.0.0"
skill_type: doc
instance_type: none
risk_level: medium
---
# Redis 内存打满处置
## 何时使用
...
也接受 skill.md;内容不能为空。
脚本包 zip 目录
my-skill/
├── SKILL.md # 必需。frontmatter + 执行说明
├── scripts/ # 必需。至少一个 .py 或 .sh
│ └── helper.py # 路径必须与 platform.json entrypoints[].script 一致
├── platform.json # 强烈建议。声明凭证模式与脚本入口
├── references/ # 可选。给人看的参考,上传校验与脚本执行都不会读
└── examples/ # 可选。示例配置,上传校验与脚本执行都不会读
校验规则:
- zip 可带一层根目录;忽略
__MACOSX - 禁止路径穿越;禁止明文密码、私钥、独立的
kubeconfig:键 entrypoints[].script必须指向包内真实文件- 缺少
platform.json时,仅对少数约定脚本(如scripts/patrol.sh、scripts/mysql_inspect/*.py)尝试推断;失败则拒收
platform.json
| 字段 | 说明 |
|---|---|
credential_mode | cli_db(命令行传参)/ env_patrol(SSH 环境变量)/ env_kube(集群 kubeconfig)/ env_kube_ssh(kubectl 跳板)/ passthrough |
runtime.interpreter | 默认 python3 |
runtime.cwd | 相对技能根目录,默认 . |
runtime.timeout_sec | 超时秒数,默认 300 |
entrypoints | id、script、action、readonly、args;args 可用 $instance.host / port / username / password |
{
"spec_version": "1.0",
"skill_type": "package_cli",
"credential_mode": "cli_db",
"runtime": {
"interpreter": "python3",
"cwd": ".",
"timeout_sec": 300
},
"entrypoints": [
{
"id": "mysql_inspect_basic",
"script": "scripts/mysql_inspect/mysql_inspect_basic.py",
"action": "check",
"readonly": true,
"args": {
"host": "$instance.host",
"port": "$instance.port",
"user": "$instance.username",
"password": "$instance.password"
}
}
]
}
env_patrol 时平台注入 PATROL_SERVER、PATROL_SSH_PASSWORD 等,脚本禁止再写 --password。
AI 如何调度技能
挂载技能 ≠ 立刻跑脚本。调度分三层:
flowchart LR
A[发现:只给 name + description] --> B[匹配后 read_skill 读全文]
B --> C{技能类型}
C -->|doc| D[按文档步骤调用内置工具]
C -->|package| E[run_skill_script 跑白名单入口]
- 发现:智能体启动时只看到技能目录(id、名称、描述)。
- 激活:任务与描述匹配时,必须先
read_skill(skill_id)。 - 执行:
doc:按正文用平台已有工具完成(查实例、跑只读检查等)。package:用run_skill_script(skill_id, entry, action);entry对应platform.json的入口 id,参数由当前会话实例注入,禁止模型手写密码。
巡检处置同一套工具:先读技能,匹配「何时使用」后再决定是否跑脚本。
没有通用 execute / 任意 shell。scripts/ 不会注册成独立 tool schema。
如何挂到智能体与巡检
| 场景 | 做法 |
|---|---|
| 智能体 | 智能体配置里勾选技能。对话时按描述匹配并调度 |
| AI 巡检 | 定时巡检配置中,给目标实例绑定技能。巡检后置处置会先读技能再按需跑脚本 |
两种入口共用同一技能库。绑定后仍走「先读后跑」,不会一挂载就执行脚本。
已提供的典型技能
Linux 服务器巡检
适用:Linux 主机健康检查、资源使用率核查。
检查项包括(示例):
- 系统负载、CPU、内存、磁盘
- systemd 失败单元
- TOP 进程
- Docker 运行状态(如有)
输出:Markdown 巡检报告。凭证走 env_patrol,不进入对话。
MySQL 巡检
适用:数据库侧定期健康与性能项检查。
价值:把 DBA 常看的检查项标准化,适合纳入定时 AI 巡检或手动触发。脚本入口用 cli_db,连接信息由绑定实例注入。
K8s 负载检测与处理
适用:集群或节点负载异常、需要定位高消耗 Pod。
价值:
- 结构化分析节点与 Pod 资源占用
- 给出负载处理建议(是否执行变更由审批策略决定)
网络设备巡检
适用:华为、H3C、Cisco 等网络设备。
价值:
- 按厂商能力做只读巡检
- 统一输出巡检报告,减少逐台登录设备
等保测评
适用:等保测评准备、自查、整改跟踪。一般为 纯文档 技能。
价值(示例方向):
- 资产梳理与发现
- 基线 / 配置检查
- 端口与服务扫描
- 漏洞扫描辅助
- 测评报告与 checklist 生成
具体检查项与合规边界以技能说明及当地等保要求为准,平台提供辅助能力,不替代正式测评机构结论。
技能包 vs 日常 AI 对话
| 对比项 | 日常 AI 对话 | 技能包 |
|---|---|---|
| 交互方式 | 自由问答 | 场景化、步骤固定 |
| 输出 | 对话为主 | 报告为主 |
| 适用 | 临时排障、ad hoc 查询 | 巡检、合规、标准化检查 |
| 实例要求 | 一般需绑定实例 | 通常要求特定实例类型 |
| 脚本 | 不跑技能包脚本 | package 才注册 run_skill_script |
与 AI 巡检的关系
- AI 智能巡检:按业务组定时跑多实例联合检查,偏「平台调度 + 协调智能体」。
- 技能包:偏「单一专项场景的深度 checklist」,可手动在对话中触发,也可挂到巡检实例上做后置处置。
详细操作见 AI 智能巡检操作指南。
适用角色
| 角色 | 典型用法 |
|---|---|
| 运维工程师 | 手动触发 Linux / MySQL / K8s 技能出报告 |
| 安全 / 合规 | 等保测评技能辅助自查 |
| 网络工程师 | 网络设备巡检技能 |
| 技能作者 | 按本页规范编写 SKILL.md 或 zip 包并导入 |
| 管理者 | 查看标准化报告,对比历史巡检结果 |
