中医思维蒸馏器 · TCM-Distiller
将任意中医师的思维体系蒸馏为可被 AI 调用的技能(Skill)
「授人以鱼,不如授人以渔」——不产出某一个中医师,而是产出能产出任何中医师的流水线。
📌 这是什么
中医思维蒸馏器是一套完整的、经过实战验证的 AI 技能蒸馏流水线——输入某位中医师的著作/讲稿/医案(一手素材),输出一个可被 AI 调用的、忠实还原其思维体系的人物技能。
与市面上"把资料塞给 AI"的简单做法不同,本蒸馏器基于 15 个蒸馏维度 + 12 个质量保障模块,确保产出的技能不只是"资料库",而是真正"会像该医家一样思考"。
已用本流水线蒸馏的人物
| 人物 | 流派 | 成果 |
|---|---|---|
| 胡希恕 | 经方派 | 38 万字讲稿 → 完整技能(首发验证案例) |
| 黄元御 | 气机升降派 | 3.5MB/38,266 行医书十一种 → V3 深度优化 |
| 吴鞠通 | 温病派 | 4 著作 → V3.5 端到端 + 359 医案 + GitHub 发布 |
| 倪海厦 | 经方派 | 258 方剂量全量勘误 + 表达还原度反超旧版 + 达尔文全流程优化(V4.5 七项经验反哺) |
🚀 快速开始
环境要求
- Python 3.8+(索引验证脚本)
- 任意支持技能(Skill)机制的 AI 平台(Claude Code / IMA / OpenClaw 等)
# 手动
git clone https://github.com/jangviktor-web/tcm-distiller.git
cp -r nihaixia/ ~/.claude/skills/tcm-distiller/
把github“https://github.com/jangviktor-web/tcm-distiller”项目安装到本地skill
openclaw skills install @jangviktor-web/tcm-distiller
npx skills add https://clawhub.ai/jangviktor-web/skills/tcm-distiller
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_ff4d9420/tcm-distiller。
✨ 核心特性
🧠 15 维度蒸馏体系
覆盖一个人物思维的全部关键层:核心心智模型 / 临床决策启发式 / 方证体系 / 表达 DNA / 反模式与诚实边界 / 剂量思维 / 饮食调理 / 条辨框架 / 生平传承 / 方证体系 / 内在张力 / 智识谱系 / FAQ / 临床安全层 / 功法体系(可选)
🛡 12 个质量保障模块(S1-S12)
| 模块 | 功能 |
|---|---|
| S1 | 古今病名映射索引 |
| S2 | 强制原文引用与回答协议(检索线索不进回答) |
| S3 | 热度驱动测试训练法(50 题实测) |
| S4 | 知识网络体检 |
| S5 | 角色扮演 7 段式 |
| S6 | 15 维度覆盖率验证 |
| S7 | 剂量勘误工作流(258 方逐方对照源文件) |
| S8 | 版本差异处理(讲课版 vs 通行本,防误判) |
| S9 | 剂量三体系换算(考古/台湾/临床直换铁律) |
| S10 | 诚实标注规范(不编造,缺口显性化 + 来源追问四段式话术) |
| S11 | 表达还原度验证(20 题长答盲评,六维差距检查) |
| S12 | 档案清理与索引健康维护(删除后索引四步验证) |
🔬 实战验证的数据
- 倪海厦 258 方剂量勘误:合格 233 / 修复 30+ 处 / 复查无回滚
- 表达还原度:20 题长答盲评从"十题全败"修复至"9 胜 1 平 0 败"(4.65 vs 4.46)
- 达尔文全流程(2026-08-15):新旧对比 90.0 vs 67.1 → 11-20 长叙事补测三向盲评 → 7 项经验反哺蒸馏器 V4.5
- 索引健康:174 条关键词引用 0 失效
- 吴鞠通 100 题热度测试:平均 7.17/10(优秀级)
使用(两条流水线)
Pipeline A · 新蒸馏(人 → skill)
Phase 0 入口分流 → Phase 1 十维并行调研 → Phase 2 框架合成 → Phase 3 质量验证 → Phase 4 增量补充 → Phase 5 交付
→ Phase 3 质量验证 → Phase 4 增量补充 → Phase 5 交付
Pipeline B · 增量优化(skill → 更好 skill)
Phase B0-B5:差距分析 → 定向增强 → 剂量勘误 → 表达还原 → 复测棘轮
一句话触发
"蒸馏胡希恕" / "把倪海厦的思维方式做成技能" / "优化吴鞠通 skill"
📂 目录结构
tcm-distiller/
├── SKILL.md # 主技能文件(双流水线 + S1-S12 模块 + 15 维度定义)
├── CHANGELOG.md # 完整版本历史(V1.0 → V4.5)
├── references/
│ ├── 01-15 维度定义 # dimensions.md(15 维深化定义)
│ ├── phase1-agents.md # 10+2 维子 Agent Prompt 模板
│ ├── phase2-checklist.md # 框架合成检查清单
│ ├── phase3-quality.md # 质量验证标准(15 维度覆盖率)
│ ├── 18-error-handling.md # 系统性错误处理与降级机制
│ ├── 20-original-text-digitalization.md # 原文数字化方法论
│ ├── 21-acceptance-testing.md # 验收测试(热度实测+负优化审计+盲评法)
│ ├── 25-index-audit.md # 索引完整性审计
│ ├── 26-dose-audit-workflow.md # 剂量勘误工作流(S7/S8/S9)
│ ├── 27-honesty-standards.md # 诚实标注规范(S10)
│ ├── 28-expression-verification.md # 表达还原度验证(S11)
│ ├── 29-archive-maintenance.md # 档案清理与索引健康(S12)
│ └── 实战案例(huxishu-case / huangyuanyu-v3-case)
└── scripts/
├── validate_keyword_refs.py # 关键词引用验证脚本
├── extract_titles.py # 原文标题提取
├── cleanup_headers.py # OCR 噪音清理
└── ...(共 9 个工具脚本)
📖 版本历史(更新日志)
V4.5(2026-08-15)· 达尔文实战七项优化
- 表达池机制:三件套升级为口头禅池+断言池(各 8-18 短语)+ 会话级去重 + 同义族合并计数 + 池尽复用间隔≥3 轮(倪海厦 10+ 轮长会话零重复实战)
- 输出四查:三查升级四查,新增"引用数量对账"(正文引用条目数 == 卡片数)
- 原文细节一致性铁律:炮制字三级判定(炙/生甘草不可互换;主动改需原话 / 转录省略按原文 / 两可按原文)
- 临床替代注记:人物主动化裁须标注(倪师乌梅代乌头、甜酒酿代白酒实例)
- 来源追问四段式话术(S10 升级):用户追问"是本人说的还是你算的"→ 总声明/口述/换算/底线
- 新旧同题盲评法(Pipeline B5 必做):三向同题盲评 + judge 六维评分,本次 ≥ 上次才通过
- 注册三步防护:注册前 zip 备份 → 注册后 grep 验证 → 被覆盖恢复
V4.4d(2026-08-15)· 档案清理与索引健康维护
- 新增 S12:权威 vs 档案分级 + 档案体检五步 + 删除后索引健康四步法
- 新增 references/29:完整方法论(倪海厦 research 目录清理实战:10 文件→删 2 修 1 标 1,删除后 174 引用 0 失效)
- 坑位沉淀:"推荐"标注的过时文件最危险 / 同错误多文件并存 / 删除留痕可追溯
V4.4c(2026-08-15)· 文件名标准化
- 产出 skill 内部文件统一
NN-english-kebab-name.md命名规范(禁中文文件名)
V4.4b(2026-08-14)· 临床剂量补齐
- Phase 4.2b:临床剂量补齐工作流(S7 下游延伸,源自倪海厦实战)
V4.4(2026-08-14)· 表达还原度方法论
- 三件套落地法:前置表达速查卡 / 输出形态铁律 / 语气量化指标(双保险)
- "改进后必须实测盲评"铁律(倪海厦 14b 事故教训:规则埋在深处=没有)
V4.3(2026-08-14)· 表达还原度验证
- 新增 S11:20 题长答盲评法 + 六维质地差距检查表 + 修复 7 技法
- A/B 双版本盲评法(21 第五节):双版本准备→3 题库并行→盲评→棘轮决策
- 多文件同知识全量核验教训(酸枣仁汤速查卡残留案例)
V4.2(2026-08-14)· 全历史会话二轮挖掘
- 平台错误码速查表(411003/411006/200005)+ 平台快照覆盖防护
- 源文件编码统一(GBK→UTF-8 校验)
- GitHub/ClawHub 发布渠道规范
- 四层结构心智模型框架(公理/定理/算法/边界层)
V4.1(2026-08-14)· 历史会话经验补注
- 安装路径修正(符号链接机制)
- 跨流派对话测试法(吴鞠通 V3.1 实测:倪驱邪 vs 吴存津)
- 语气量化评估法(互动追问/模板/舞台指示计数)
- "不编造 ≠ 不缺失"平衡原则
V4.0(2026-08-13)· 剂量勘误方法论注入
- 新增 S7 剂量勘误工作流(五步:清单→提取→二次检测→P0-P3 修复→报告)
- 新增 S8 版本差异处理(以源文件讲课版为准,防 judge 通行本误判)
- 新增 S9 剂量三体系(①考古考证 ②台湾临床 ③临床直换铁律:古方一两=临床一钱)
- 新增 S10 诚实标注规范(五类必标场景 + 子 Agent 复核纪律)
V3.x(2026-08-09 ~ 08-13)· 端到端与索引体系
- V3.6:索引引用规范化(
文件 搜"关键词"格式)+ validate_keyword_refs.py - V3.5:端到端蒸馏完成(吴鞠通全流程验证)
- V3.1:5 项内化升级(description/安全声明/分域取法/功法维度/用药铁律原文出处)
V1.0 - V2.x(2026-08-04 ~ 08-09)· 奠基
- 胡希恕 38 万字讲稿首发验证
- 黄元御 3.5MB 医书十一种深度案例
- 9 维评分基线 79.5 → 84.3
完整更新日志见 CHANGELOG.md
🛠 技术亮点
棘轮机制(只进不退)
每个优化都经过:评分 → 改进 → 实测 → 独立盲评 → 保留或回滚——只保留被实证的改进,自动回滚退步。
独立盲评(不自己改自己评)
评分/judge 全部用独立子 agent,标记 A/B 打乱,只凭质量打分——杜绝"自我感觉良好"。
剂量三体系(防误判)
考古换算(1两≈15.6g)仅理解原方规模;临床开方一律"古方一两=临床一钱"直换——解决了 AI 测试中长期存在的 judge 误判问题。
表达池与四查(V4.5 新增)
口头禅/断言池化管理 + 会话级去重,10+ 轮长对话不重复;输出四查含引用数量对账,正文提到几个方剂就出几张卡——把"像不像"从玄学变成可检查的清单。
🤝 贡献
欢迎通过以下方式参与:
- 🐛 报告问题:提交 Issue(附复现步骤)
- 💡 建议新维度/新模块
- 📚 分享你的蒸馏案例(格式参考 references/huxishu-case.md)
⚠️ 免责声明
- 本项目用于教育与学术研究,产出的人物技能仅供学习其思维方法论
- 所有中医相关内容不构成医疗建议,临床用药请咨询执业中医师
- 人物技能的表述基于公开讲义/著作,不代表人物本人观点
Made with ❤️ for the TCM community
No comments yet
Be the first to share your take.