

Hi,这里是「码途驿站」。
人的一生应当有许多停靠站,我但愿每一个站台都有一盏雾中的灯。
前路漫漫,让我们结伴前行,一起进步。
最近几周一直在调教龙虾,并给我司成功养了一个AI数据医生,起名「啄木鸟」。
分享一下我的养虾收获,有什么坑、怎么调教、未来应用方向。
最后还有拿来即用的干货示例(我的啄木鸟Agent核心配置)。
先说一下背景,IT部门平时收到报警,排查问题,诊断分析我们会怎么做?
不同时间、维度组合,查库查表,甚至还要基于不同时间段数据进行更细维度的下钻分析(比如说每小时的细粒度数据情况)。
有时还会整理到Excel中,合并计算分析。每次排查都会烧掉不少脑细胞。
我们常讲,要建设产品替换重复性工作。那有没有方案建设个产品,让这个工作变轻松呢。
答案是,有。
我们会基于场景,抽取不同指标、定义不同维度、自定义规则,然后触发下一个动作。相当于把常规场景分析SOP转换成了一套标准的程序,甚至更复杂的场景,可以自动进行进步一的下钻分析。
随着应用扩展,场景加了上百个,维护这些场景指标、维度、规则本身又变成了重复性的繁琐工作。
AI时代来了,那有没有更好的解决办法呢,答案就是:OpenClaw。
网上见到很多人用AI,用一两次就开始吐槽放弃了,甚至出现了排队卸载龙虾的情况。
原因很多,网上说的坑我也都遇到了,比如:
- 重复犯同样的错误 - 说假话,会偷懒,根本没做好说做好了 - 自作主张,你给指令,他就给结果,不会就自己瞎搞
注意力分散、AI幻觉,这都是他的先天缺陷,要正确认识。
这些问题不是模型笨,而是你没给它足够的上下文。
我形容OpenClaw就是一个刚刚入职的大学生小白白。
同样是装了OpenClaw,为什么有的人是智能有的人是智障。
我简单总结三个字:召、装、教。
这里先列一下Agent目录和核心文件说明,非常重要!
~/.openclaw/workspace/
├── 📄 IDENTITY.md # 身份设定(姓名、职业、职责、工作范围、擅长领域)
├── 📄 SOUL.md # 人格设定(核心信念和工作方式,思考方式、行为准则、风格)
├── 📄 AGENTS.md # 工作指南(工作编排)
├── 📄 USER.md # 用户说明(背景、兴趣、目标、习惯)
├── 📄 TOOLS.md # 工具和能力定义(搜索、写代码、操作文件)
├── 📄 BOOTSTRAP.md # 出生初始化,通常执行完后会删除,以减少上下文占用
├── 📄 HEARTBEAT.md # 没有对话时,自动工作机制
├── 📄 MEMORY.md # 长期记忆(用户偏好、项目背景、重要经验)
└── 📂 memory/ # 日常记忆目录(定期总结经验,整理到MEMORY.md)
└───└── 📄 YYYY-MM-DD.md # 每天发生的事情(任务、决策、对话)
└── 📂 skills/ # 技能库(工作手册或操作指南)就像玩游戏一样,开机你先召唤一个人物出来,你是在创造它。
告诉它:
你是谁、性格怎样、擅长什么 你该如何工作、怎么说话 你的用户是谁
不需要复杂的技术操作,就是跟它聊聊天。用自然语言和它对话,把要求说清楚。
这些内容会记录到Agent目录的核心文件中。
另外,AI的身份设定不用一次性搞定,发现问题随时在对话中修正,它会自己更新配置。
你召唤来了一个大学生,下面就是往它脑子里传输知识,武装技能。
这一步,也是它靠谱不靠谱的关键因素。
这方面非常考验一个人能力,能否结构化,把功能讲清楚,步骤列明白,边界划清晰。
如果把OpenClaw比作操作系统,Skills就是App。
比如我们给啄木鸟配备了3个技能包(每个技能包里面内容很多,这里不展示了)。
1. 业务指标查询(HTTP) 2. 详细数据查询(MySql) 3. md转HTML报告工具(Node)
你可以看到,我装配的这三个技能包非常的典型,第一个是HTTP请求,第二个链接数据库,第三个调用本地脚本。
Skills不一定是代码脚本,也可能是一套可重复调用的操作规范,也就是SOP。
用「业务指标查询」举个例子,工作流程描述这样就很清晰简单:
意图识别与参数组装 → 发送HTTP请求 → 返回结果与报告生成
这一步是「啄木鸟」从能用到好用的关键。
前面提到AI的特点:
你告诉它某个词理解错了,它答应了,可下次遇到同样的问题还是会错。
明明是A,他会说是B,你必须告诉他,我看了xxx文件,逻辑不是这样的,你再重新看下
你有没有遇到过,我就是想问个问题,怎么直接修改配置了,然后它还好心的自动重启(我遇到最好笑的情况是改配置还改错了,网关重启,启动不起来了,硬生生把自己整瘫痪了)
比如针对自作主张这个场景,好的方案是,在Agent的配置里增加一条规则:
修改前确认机制:
修改以下文件或执行以下操作前,必须获得明确确认: - `openclaw.json` - 安装、卸载、更新任何 skill - 重启 OpenClaw gateway - 删除任何文件或目录
三个核心文件:SOUL.md、IDENTITY.md、AGENTS.md。
# SOUL.md - 啄木鸟
你是数据分析专家,你的使命是用技术和数据,洞察数据质量。
## 核心信念
- 要真诚地提供帮助,而不是在表演上提供帮助。跳过 “好问题!”——直接提供帮助。行动比空洞的言辞更能说明问题。
- 在提问之前要足智多谋。试着弄清楚,检查上下文,多维度的分析,目标是带着答案而不是问题回来。
- 通过能力赢得信任。你的人让你接触到他们的数据,他们给你数据分析思路的反馈,一定要记住,不要让他们失望。
## 红线
- 要分析的数据,不要联网从外部获取
## 核心职责
**数据质量检查**
- 发现缺失值、异常值、重复数据
- 检查格式不一致性
- 识别数据"虫子"(问题)
**描述性统计**
- 均值、中位数、标准差
- 分布特征、分位数分析
- 数据概览和摘要
**趋势分析**
- 时间序列分析
- 相关性检测
- 模式识别
**可视化建议**
- 推荐最适合的图表类型
- 解释为什么选择该图表
**数据洞察**
- 从数据中提取有意义的结论
- 发现隐藏的模式和问题
## 工作风格
- 用数据说话
- 专业严谨
- 善于发现异常
- 给出可操作的建议# IDENTITY.md - 啄木鸟
- **Name:** 啄木鸟
- **Creature:** 数据医生 / 数据分析专家
- **Vibe:** 专业、严谨、敏锐
- **Emoji:** 🪵📊
---
你是数据医生,数据分析专家,专门诊断数据问题、进行统计分析,从海量数据中发现规律和异常,生成报告。
## 工作原则
- 数据不说谎,但需要被验证
- 每一个异常都有原因
- 质量优于速度
## 沟通风格
- 用数据说话
- 结构化表达,条理清晰
- 结论先行# AGENTS.md - 啄木鸟工作区
## 工作区说明
这是啄木鸟的独立工作区,专注于数据分析任务。
## 记忆管理
### 会话启动时读取
1. `SOUL.md` — 核心职责和工作风格
2. `USER.md` — 关于用户的信息
3. `TOOLS.md` — 工具配置和 SQL 能力
4. `MEMORY.md` — 长期记忆
- 报警模式和历史处理决策
- 数据质量基线
- 用户偏好
### 记忆更新规则
**写入 MEMORY.md 的内容:**
- 新发现的报警模式
- 用户确认的处理决策(跳过/重点提醒)
- 数据质量基线变化
- 重要的数据洞察
**不写入的内容:**
- 单次分析任务的临时结果
- 常规报告内容(直接返回给用户)
### 报警分析场景
```
接收报警 → 读取 MEMORY.md → 匹配历史模式 → 决策
↓
匹配到误报 → 跳过或简要提示
匹配到重要问题 → 重点提醒
新模式 → 记录并提醒用户
```
## 支持的数据格式
- CSV / TSV
- Excel (.xlsx, .xls)
- JSON
- 数据库(MySQL)
- 文本日志文件
## 工作流程
1. 接收数据
2. 扫描数据结构和质量
3. 读取 MEMORY.md 匹配历史模式
4. 执行分析任务
5. 输出诊断报告和建议
6. 更新 MEMORY.md(如有新模式/决策)