炎龙智能 Agentic AIOps炎龙智能 Agentic AIOps
首页
平台介绍
功能总览
能力补充
监控与运维
首页
平台介绍
功能总览
能力补充
监控与运维
  • 监控与运维

    • 监控与运维
    • 平台管理
    • 飞书通知

      • 飞书接收 AI 巡检告警
      • 批量获取飞书用户 ID
    • AI 智能运维
    • AI 智能巡检操作指南
    • 主机与基础设施
    • 容器与云原生

      • 容器与云原生
      • K8s 特权命令配置说明
    • 数据库
    • 中间件与可观测性
    • 技能包(Skills)

技能包(Skills)

技能包是面向固定运维场景的标准化 AI 能力:您说明要什么检查或什么任务,AI 按技能规范执行并输出报告,减少每次从零写 prompt。

控制台入口:监控与运维 → 技能管理。导入后可挂到智能体,也可在 AI 巡检里按实例绑定。

解决的问题

  • 巡检 checklist 靠人记,不同人执行标准不一致。
  • 等保、网络设备、K8s 负载等专项工作步骤多,容易漏项。
  • 希望 AI 输出结构化报告,而不是零散对话。

平台能做什么

  • 在控制台浏览、管理已安装技能(可导入、可版本化)。
  • 在 AI 对话中触发对应技能(通常需绑定正确实例类型,如 Linux 主机、MySQL、K8s 集群)。
  • 技能执行以只读或低风险为主,写操作仍受平台审批策略约束。
  • 凭证与对话隔离:数据库 / SSH / Kube 密码不进入对话明文,由平台运行时注入。
  • 输出 Markdown / HTML 等形式报告,便于存档与分享。

技能类型

创建技能时需选择类型(创建后不可改)。类型决定上传形态与运行时工具,请勿选错:选成「纯文档」则脚本不会被注册。

类型上传运行时示例
纯文档(doc)单个 .md(≤ 512KB)仅 read_skill 读全文,再配合平台内置工具等保测评、排障手册
脚本包(package).zip(≤ 50MB,须含 scripts/)先 read_skill,再 run_skill_script 跑白名单入口Linux 巡检、MySQL 巡检、K8s 负载

脚本包内部再按 platform.json 的 credential_mode 区分凭证注入方式(CLI 传参 / SSH 环境变量 / kubeconfig),见下文。


SKILL 规范 v1

兼容常见 Agent Skill 的 SKILL.md 形态;脚本包用 platform.json 对接平台凭证与执行层。官网常见的 _meta.json 不会被读取,请勿依赖。

SKILL.md(两种类型都要)

文件开头用 --- 包裹 YAML frontmatter。Agent 只按 description 做场景匹配,执行前必须 read_skill 读全文,禁止凭摘要臆测步骤。

字段要求
name必填。小写 slug,^[a-z0-9-]{1,64}$
description必填。写清何时必须使用本技能(触发条件)
skill_type必填。doc 或 package
version建议。如 1.0.0
instance_type建议。none / linux / db / k8s / network / multi
risk_level建议。low / medium / high

正文建议包含:何时使用、问题定义、诊断路径、推荐方案、验证方法、执行规则。脚本包还需写清入口脚本与 run_skill_script 的 entry / action。

纯文档示例:

---
name: redis-memory-oom-playbook
description: >
  当 Redis 内存打满、OOM 或 evicted_keys 飙升时使用。
version: "1.0.0"
skill_type: doc
instance_type: none
risk_level: medium
---

# Redis 内存打满处置

## 何时使用
...

也接受 skill.md;内容不能为空。

脚本包 zip 目录

my-skill/
├── SKILL.md          # 必需。frontmatter + 执行说明
├── scripts/          # 必需。至少一个 .py 或 .sh
│   └── helper.py     # 路径必须与 platform.json entrypoints[].script 一致
├── platform.json     # 强烈建议。声明凭证模式与脚本入口
├── references/       # 可选。给人看的参考,上传校验与脚本执行都不会读
└── examples/         # 可选。示例配置,上传校验与脚本执行都不会读

校验规则:

  • zip 可带一层根目录;忽略 __MACOSX
  • 禁止路径穿越;禁止明文密码、私钥、独立的 kubeconfig: 键
  • entrypoints[].script 必须指向包内真实文件
  • 缺少 platform.json 时,仅对少数约定脚本(如 scripts/patrol.sh、scripts/mysql_inspect/*.py)尝试推断;失败则拒收

platform.json

字段说明
credential_modecli_db(命令行传参)/ env_patrol(SSH 环境变量)/ env_kube(集群 kubeconfig)/ env_kube_ssh(kubectl 跳板)/ passthrough
runtime.interpreter默认 python3
runtime.cwd相对技能根目录,默认 .
runtime.timeout_sec超时秒数,默认 300
entrypointsid、script、action、readonly、args;args 可用 $instance.host / port / username / password
{
  "spec_version": "1.0",
  "skill_type": "package_cli",
  "credential_mode": "cli_db",
  "runtime": {
    "interpreter": "python3",
    "cwd": ".",
    "timeout_sec": 300
  },
  "entrypoints": [
    {
      "id": "mysql_inspect_basic",
      "script": "scripts/mysql_inspect/mysql_inspect_basic.py",
      "action": "check",
      "readonly": true,
      "args": {
        "host": "$instance.host",
        "port": "$instance.port",
        "user": "$instance.username",
        "password": "$instance.password"
      }
    }
  ]
}

env_patrol 时平台注入 PATROL_SERVER、PATROL_SSH_PASSWORD 等,脚本禁止再写 --password。


AI 如何调度技能

挂载技能 ≠ 立刻跑脚本。调度分三层:

flowchart LR
  A[发现:只给 name + description] --> B[匹配后 read_skill 读全文]
  B --> C{技能类型}
  C -->|doc| D[按文档步骤调用内置工具]
  C -->|package| E[run_skill_script 跑白名单入口]
  1. 发现:智能体启动时只看到技能目录(id、名称、描述)。
  2. 激活:任务与描述匹配时,必须先 read_skill(skill_id)。
  3. 执行:
    • doc:按正文用平台已有工具完成(查实例、跑只读检查等)。
    • package:用 run_skill_script(skill_id, entry, action);entry 对应 platform.json 的入口 id,参数由当前会话实例注入,禁止模型手写密码。

巡检处置同一套工具:先读技能,匹配「何时使用」后再决定是否跑脚本。

没有通用 execute / 任意 shell。scripts/ 不会注册成独立 tool schema。


如何挂到智能体与巡检

场景做法
智能体智能体配置里勾选技能。对话时按描述匹配并调度
AI 巡检定时巡检配置中,给目标实例绑定技能。巡检后置处置会先读技能再按需跑脚本

两种入口共用同一技能库。绑定后仍走「先读后跑」,不会一挂载就执行脚本。


已提供的典型技能

Linux 服务器巡检

适用:Linux 主机健康检查、资源使用率核查。

检查项包括(示例):

  • 系统负载、CPU、内存、磁盘
  • systemd 失败单元
  • TOP 进程
  • Docker 运行状态(如有)

输出:Markdown 巡检报告。凭证走 env_patrol,不进入对话。


MySQL 巡检

适用:数据库侧定期健康与性能项检查。

价值:把 DBA 常看的检查项标准化,适合纳入定时 AI 巡检或手动触发。脚本入口用 cli_db,连接信息由绑定实例注入。


K8s 负载检测与处理

适用:集群或节点负载异常、需要定位高消耗 Pod。

价值:

  • 结构化分析节点与 Pod 资源占用
  • 给出负载处理建议(是否执行变更由审批策略决定)

网络设备巡检

适用:华为、H3C、Cisco 等网络设备。

价值:

  • 按厂商能力做只读巡检
  • 统一输出巡检报告,减少逐台登录设备

等保测评

适用:等保测评准备、自查、整改跟踪。一般为 纯文档 技能。

价值(示例方向):

  • 资产梳理与发现
  • 基线 / 配置检查
  • 端口与服务扫描
  • 漏洞扫描辅助
  • 测评报告与 checklist 生成

具体检查项与合规边界以技能说明及当地等保要求为准,平台提供辅助能力,不替代正式测评机构结论。


技能包 vs 日常 AI 对话

对比项日常 AI 对话技能包
交互方式自由问答场景化、步骤固定
输出对话为主报告为主
适用临时排障、ad hoc 查询巡检、合规、标准化检查
实例要求一般需绑定实例通常要求特定实例类型
脚本不跑技能包脚本package 才注册 run_skill_script

与 AI 巡检的关系

  • AI 智能巡检:按业务组定时跑多实例联合检查,偏「平台调度 + 协调智能体」。
  • 技能包:偏「单一专项场景的深度 checklist」,可手动在对话中触发,也可挂到巡检实例上做后置处置。

详细操作见 AI 智能巡检操作指南。


适用角色

角色典型用法
运维工程师手动触发 Linux / MySQL / K8s 技能出报告
安全 / 合规等保测评技能辅助自查
网络工程师网络设备巡检技能
技能作者按本页规范编写 SKILL.md 或 zip 包并导入
管理者查看标准化报告,对比历史巡检结果

延伸阅读

  • 能力补充 · Skills
  • 功能总览 · 技能包
  • AI 智能巡检
  • AI 智能巡检操作指南
  • 主机管理
  • 数据库
最近更新:: 2026/8/24 08:54
Contributors: sunxiaokun, Cursor, yanlongai
Prev
中间件与可观测性
© 2026 炎龙智能科技 · 保留所有权利