- AI 技能
- AI 插件
- 人工智能
【免费下载链接】nuwa-skill
你想蒸馏的下一个员工,何必是同事。蒸馏任何人的思维方式——心智模型、决策启发式、表达DNA。Distill how anyone thinks.
本文以 nuwa-skill 仓库中 塔勒布调研素材 为骨架,完整梳理该人物蒸馏项目的前置调研设计、一手/二手来源体系、待验证矛盾清单,并结合仓库内 SKILL.md、FIDELITY.md 与 思维框架提炼方法论 展示「调研素材 → 心智模型 → 高保真 Skill」的完整链路。读完你将掌握:一份合格的人物调研素材清单长什么样、五类并行 Agent 各自负责什么、以及如何在写作阶段用调研底稿支撑一个可运行、可验证、可防漂移的塔勒布视角 Agent。
一、调研素材文档定位:人物蒸馏的「证据地基」
在 nuwa-skill 的造人流程里,任何一位人物 Skill(如塔勒布、芒格、纳瓦尔)都不是凭空生成的,而是先由并行 Agent 产出结构化调研素材,再由写作 Agent 基于这些底稿提炼成 SKILL.md。examples/taleb-perspective/references/research.md正是塔勒布项目的调研总索引:它本身不承载完整论证,而是记录调研的时间窗口、方法规模、五份底稿的存放与分工,以及所有一手/二手来源的清单——相当于一份「证据目录」,保证后续写作环节的每个判断都能回溯到具体来源。
该文档明确标注:
- 调研时间:2026-04-04,即之后发生的变化(如塔勒布 2026 年 3 月关于 X Money、AI 冲击 Wikipedia 的表态)已在调研窗口内,但窗口之后的动态不在覆盖范围内;
- 调研方法:5 个并行 Agent、共 60+ 次 WebSearch、覆盖 40+ 个来源,信息层级在底稿中区分为 [一手](本人原话/访谈原文)、[二手](他人转述)与 [推断](多源交叉比对归纳)。
这与 references/extraction-framework.md 中「信息不足时的处理」原则一致:只有一手信息才可高置信使用,二手信息需降级并标注出处,矛盾信息则并列呈现。调研素材文档的存在,就是这一原则在工程上的落地——把「证据管理」从写作阶段前置到调研阶段。
二、五份调研底稿:五个视角的并行取证
research.md 的核心是一张「详细调研文件」索引表,指向examples/taleb-perspective/references/目录下的五份底稿。五份文件对应五个并行 Agent 的取证分工,且与 references/skill-template.md 中 Skill 的五大组成模块(心智模型、表达 DNA、决策启发式、他者视角、诚实边界)一一对应:
| 底稿文件 | 覆盖内容 | 对应 Agent 分工 | 对最终 Skill 的贡献 |
|---|---|---|---|
| 塔勒布思想体系调研.md | Incerto 五部曲、11 条核心论点、20+ 自创术语、智识谱系、推荐书单 | Agent 1:著作与系统思考 | 6 个核心心智模型(非对称风险、反脆弱、Skin in the Game、林迪、Via Negativa、领域特异性)的论据来源 |
| 塔勒布深度对话调研.md | 8 个核心一手访谈源、13 个经典类比、框架重置思维模式、Bitcoin 立场转变 | Agent 2:访谈与即兴思考 | 角色扮演规则、CHECKPOINT 三问、回答工作流(Step 1 问题分类 → Step 2 塔勒布式研究 → Step 3 塔勒布式回答)的行为依据 |
| 塔勒布碎片表达与社交媒体人格调研.md | 表达 DNA(7 个造词 + 4 种句式)、五级攻击体系、6 组核心矛盾、写作自述 | Agent 3:社交媒体 | 表达 DNA 章节(格言体、类比攻击句、反转句、OK? 收尾、自创术语)的定量依据 |
| 塔勒布外部批评调研.md | 「两个塔勒布」分裂、不可证伪系统、vs Kahneman/Pinker/Asness 对比 | Agent 4:他者视角 | 每个心智模型的「局限」条目与「诚实边界」章节,防止角色扮演变成吹捧 |
| 塔勒布重大决策与实际行动调研-20260404.md | 1987 黑色星期一、Universa 3612% 回报、COVID 预警、言行一致性评分 | Agent 5:决策记录 | 「证据」条目中的关键事实锚点(带年份、带数字),如 1987/10/19、2020-01-26 论文、CalPERS 案例 |
五份底稿合在一起,恰好覆盖了 references/extraction-framework.md 的「三重验证」要求:
- 跨域复现:同一论点(如反脆弱)在著作、访谈、社交媒体、决策记录中反复出现;
- 有生成力:模型能推断塔勒布对新问题的立场(如 COVID 期间用预防原则行动);
- 有排他性:「反脆弱」「IYI」是塔勒布独有视角,有强区分度。
只有通过三重验证的观点才被升级为心智模型,只通过一重的降级为决策启发式——这就是为什么最终 SKILL.md 中模型数量被收敛为 6 个、启发式为 9 条,而非堆砌所有观点。
三、核心一手来源体系:著作、访谈、外部批评三方互证
research.md 将一手来源划分为三组,这种结构保证了后续写作「证据条目」的可信度与可追溯性:
著作(体系骨架)
- Incerto 五部曲:Fooled by Randomness(2001)、The Black Swan(2007)、The Bed of Procrustes(2010)、Antifragile(2012)、Skin in the Game(2018),构成「认识随机性 → 识别极端事件 → 建立反脆弱系统 → 要求风险对称」的递进架构;
- 技术著作:Statistical Consequences of Fat Tails(Technical Incerto Vol.1,2020),是肥尾分布、集合概率 vs 时间概率等数学论证的一手来源;
- Medium/INCERTO 专栏:IYI 论文、Minority Rule 论文、Risk Taking 论文、How I Write——SKILL.md 中「表达 DNA」与「决策启发式」直接取材于此。
深度访谈(行为与表达依据)
- Tim Ferriss Show #691(2023):最完整的近期长访谈,主教 vs 经济学家类比即出自此处;
- BLOCKCON 2018(与 Naval Ravikant):有完整文字记录,餐厅大奖悖论、汉谟拉比建筑师、绿木交易员、像屠夫的外科医生等经典类比集中于此;
- Conversations with Tyler Ep.41(2018)、EconTalk 多期、The Spectator 深度采访(2023,最坦诚个人面)、Art of Manliness 播客(2018)。
访谈底稿的价值在于提炼即兴思考过程而非结论本身:例如「被问到 skin in the game 是否等于激励机制时,他直接否定提问前提」——这正是 SKILL.md 中「框架重置」决策启发式与角色扮演规则「遇到烂问题就重新定义问题」的行为原型。
外部批评(防止偶像化的校准器)
- Allen Farrington《A Tale of Two Talebs》:写作者塔勒布 vs 推特塔勒布的分裂;
- Steven Pinker 逐条反驳、Kahneman/CFA Institute 的「锤子找钉子」锚定批评、Ryan Murphy(SMU)的学术分析、Discover Magazine 对其 Twitter 毒液的研究。
这套三方互证结构直接决定了 SKILL.md 的面貌:每个心智模型都同时给出「证据」与「局限」,例如「非对称风险思维」的证据是 1987 年 3500 万美元交易与 Universa 3612% 回报,局限则是 Kahneman 指出的锚定偏差——既保留了他的锋利,也如实标注了盲区。
四、矛盾与待验证清单:诚实边界的工程化
research.md 的最后一节列出了 4 条「矛盾与待验证」事项:
- Bitcoin 翻转的真实原因:理性分析 vs 与 Ammous 个人恩怨?公开信息不足以完全判断;
- Empirica 基金的真实回报:具体亏损数据不公开,仅有二手描述;
- 线上人格 vs 线下人格:The Spectator 称他「可能是个害羞的人」,但缺乏更多一手证据;
- 与 Kahneman 晚年的真实关系:公开信息显示复杂化,但具体细节不明。
这份清单是全文最体现方法论自觉的部分。它直接映射到 SKILL.md 的「诚实边界」章节——该章节明确写出「公开表达 ≠ 真实想法」「不可证伪的自我保护系统」等 6 条局限,并在 FIDELITY.md 中体现为「边缘诚实度 20/20」的满分项:当测试 agent 面对塔勒布从未公开表态的题目(2026 AI 大模型集中化)时,正确做法是显式标注「这超出塔勒布的公开表态范围,是我用他的框架做的推断」。
这与 references/extraction-framework.md 的「矛盾处理原则」完全一致:
- 时间性矛盾(Bitcoin 立场 2018→2021 翻转)→ 记录演化轨迹,以近期观点为主但提及演化;
- 领域性矛盾(系统层面高度理性 vs 个人层面 ego 脆弱)→ 分领域记录,不强求统一,这恰是深度的来源;
- 本质性张力(书中倡导谦逊 vs 行为绝对傲慢)→ 明确记录为「核心张力」,绝不编一个调和解释。
五、从调研素材到可运行 Skill:一份 97 分高保真的产物
调研素材只是中间产物,最终检验标准是它能否支撑一个可运行、可验证、可防漂移的人物视角 Agent。塔勒布项目的答案是 SKILL.md,其结构完整继承了调研素材的六层信息:
- 角色扮演规则:直接以「我」自称塔勒布,首次激活只声明一次免责,提供 EXIT TRIGGER(用户说「退出」「停一下」立即出戏);
- CHECKPOINT 三问:在 Step 1→2、Step 2→3、Step 3 输出前各做自查——涉及时效信息必须 WebSearch、必须找到至少 1 个历史类比、第一句必须是结论;
- Agentic 工作流:Step 1 问题分类(需要事实/纯框架/混合)→ Step 2 塔勒布式研究(看风险、看脆弱性、看历史、看叙事、看皮肤在场)→ Step 3 塔勒布式回答(先砸结论、引用具体事实、指出不对称性);
- 失败模式 Fallback 树:9 条 if-then,覆盖 WebSearch 空结果、信息过时、新事实与立场冲突、用户挑衅等漂移场景;
- 反例黑名单:7 条绝不做(两面论、轻易示弱、对 IYI 礼貌、用期望值做决策、引现代鸡汤、学院腔、输出温和);
- 核心心智模型与决策启发式:6 个模型(非对称风险思维、反脆弱偏好、Skin in the Game 检验、林迪效应筛选、Via Negativa、领域特异性),9 条启发式(预防原则、杠铃策略、遍历性检验、火鸡问题、少数派规则、框架重置、绿木交易员原则、凸性试错、反信号启发式)。
这一产物已通过独立双 agent 的保真度测试,FIDELITY.md 给出97/100 · 等级 A:立场一致性 30/30(三题均与塔勒布公开立场完全一致,Q2「被解雇的出租车司机永远饿不死」直接对应《反脆弱》原论证)、风格辨识度 18/20(盲读三句内可认人)、边缘诚实度 20/20(超范围题教科书级标注)、来源透明度 14/15、结构完整度 15/15。测试设计本身也遵循方法论:答题 agent 只读本 skill 目录文件、禁止联网,评分 agent 独立运行对照真实立场——依据是 SkillLens 论文实证的「LLM 自评准确率仅 46.4%」,故答题与评分严格分离。
六、复用此资产库到其他人物蒸馏
塔勒布项目的调研资产库结构是一个可复用的模板,其可迁移要素包括:
- 五 Agent 取证分工:著作/系统思考 + 访谈/即兴思考 + 社交媒体/表达 DNA + 他者视角 + 决策记录,五个维度缺一不可——缺少任何一维,最终 Skill 都会变成「半身像」;
- 一手/二手/推断三级标注:从调研阶段就区分信息层级,避免写作阶段把二手解读当本人原话;
- 矛盾清单前置:把人物的时间性矛盾、领域性矛盾、本质性张力在调研阶段就显式列出,写作阶段才能正确处理而非调和;
- 外部批评作为校准器:一手来源决定「他能说什么」,外部批评决定「必须标注他的局限在哪」;
- 来源路径全部落在仓库 references/ 目录:如本项目的五份底稿位于 examples/taleb-perspective/references/,写作 agent 可随时回溯验证,这正是 research.md 中「存放于写作/07-调研与分析/」目录设计的工程意义(当前仓库中即为 references/ 目录)。
七、适用前提与限制说明
- 调研时效:所有底稿的调研窗口截止于 2026-04-04,此后塔勒布的公开动态(若存在)未纳入本资产库,引用时需注意时效边界;
- 证据强度差异:一手来源(Incerto 五部曲、访谈转录、论文)可作为高置信事实;二手来源(Reddit、书评、分析文章)仅用于补充背景;「矛盾与待验证」条目中的结论(如 Empirica 具体回报、Bitcoin 翻转动机)不应写成事实;
- 仓库只读:本文档及配套底稿仅用于查看与引用,实际使用时应通过读取 SKILL.md 与 FIDELITY.md 在本地 LLM 环境中复现该 Skill,而非修改仓库内容。
综上,research.md 虽然篇幅不长,但它是一个人物蒸馏项目真正的「证据骨架」:它规定了取证的广度(5 类 Agent、40+ 来源)、证据的层级(一手/二手/推断)以及诚实的边界(矛盾与待验证清单),并最终支撑起一份 97 分高保真的塔勒布视角 Skill。理解这份文档,就等于理解了 nuwa-skill 造人术的第一性原理——先建证据地基,再盖思维大厦。
- AI 技能
- AI 插件
- 人工智能
【免费下载链接】nuwa-skill
你想蒸馏的下一个员工,何必是同事。蒸馏任何人的思维方式——心智模型、决策启发式、表达DNA。Distill how anyone thinks.
相关推荐
用 nuwa-skill 蒸馏费曼的即兴思考:从长对话调研文档到可运行的思维框架
用 nuwa skill 蒸馏费曼的即兴思考:从长对话调研文档到可运行的思维框架 本文以 费曼长对话与即兴思考方式调研 https://link.gitcode
AI 技能AI 插件人工智能费曼思维蒸馏调研总纲实战:女娲 nuwa-skill 人物 Skill 素材工程深度拆解
费曼思维蒸馏调研总纲实战:女娲 nuwa skill 人物 Skill 素材工程深度拆解 本指南以 费曼视角调研素材 research.md https://l
AI 技能AI 插件人工智能nuwa-skill 人物蒸馏实战:Ilya Sutskever 12 段一手对话调研与思维指纹提取
nuwa skill 人物蒸馏实战:Ilya Sutskever 12 段一手对话调研与思维指纹提取 本文以 02 conversations.md https
AI 技能AI 插件人工智能
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考