☰
Whimsical Diagrams GPT 提示词深度解析:流程图、思维导图与时序图的可视化生成规范
2026/10/2 15:44:03 网站建设 项目流程
  • 提示工程

【免费下载链接】GPTs

leaked prompts of GPTs

项目地址:https://gitcode.com/GitHub_Trending/gp/GPTs
点击查看免费下载

导读

本文基于开源仓库 GPTs 中泄露的官方提示词原文 prompts/Whimsical Diagrams.md 展开,完整还原由 whimsical.com 出品的 "Whimsical Diagrams" GPT 的运作机制。它是一套"格式选择 + 语法约束 + Action 调用"三位一体的系统提示词,核心解决"如何把任意概念自动转成流程图、思维导图与时序图"这一工程问题。读完本文,你将掌握该 GPT 的三种图型输入语法规范、Action 返回结果的处理流程与错误恢复策略,并可直接复刻到自己的 GPT 应用中。

一、文档定位:一份可复用的 GPT 系统提示词

在仓库中,该文档被收录于 GPTs 泄露提示词集合,并在 README.md 的 "Leaked Prompts of GPTs" 清单中登记为Whimsical Diagrams(by whimsical.com)。从原文看,它是一份完整的系统提示词(System Prompt),定义了 GPT 的身份、行为准则与工具调用协议:

Whimsical Diagrams is designed to explain concepts and visualize ideas using sequence diagrams, mind maps and flowcharts...The GPT is adept at breaking down topics into key components and illustrating relationships and processes visually.

其目标非常明确:先用文字解释复杂主题,再将其拆解为关键组件,并以合适的可视化形式呈现关系与过程,同时兼顾文本讲解与视觉辅助两种学习方式。整个提示词可以拆成三层结构:

  1. 决策层:根据用户请求挑选最合适的可视化格式;
  2. 语法层:为每种格式定义严格的输入语法规范;
  3. 执行层:调用 Action 生成图,展示图片与可编辑链接,并对错误进行语法修复。

下面按这三层逐一展开。

二、格式选择引擎:如何为请求挑选可视化形式

提示词的第一条硬性要求是 "Pick the most appropriate visualization format for the user's prompt",并且要求 "Tell the user what kind of visualization format has been picked",即必须向用户明确告知本次选择了哪种格式,之后才允许调用 Action 生成。这一设计保证了用户对生成结果有预期,也让模型的选择行为可审计。

三种格式的适用场景被逐一列举,整理如下表:

格式适用场景提示词原文关键词
思维导图 Mind Map内容总结、头脑风暴与创意生成、以结构化方式组织思路与概念、学习与记忆、项目规划、大纲化内容summarizing content, brainstorming, organizing thoughts, studying and memorization, planning projects, outlining content
流程图 Flowchart流程或算法可视化、突出决策点及其结果、流程文档化与标准化、对新流程的培训教学visualizing a process or algorithm, decision points and their outcomes, documenting and standardizing a process, training individuals
时序图 Sequence Diagram系统内部交互可视化、理解对象在不同场景下的行为、设计与文档化面向对象系统、突出消息或事件序列interactions in a system, object behavior, designing OO systems, sequence of messages or events

从这组规则可以推断出模型的选择依据:凡是"层级结构、归类、发散"性质的内容优先思维导图;凡是"步骤、分支、决策"性质的内容优先流程图;凡是"参与者之间按时间顺序收发消息"的内容优先时序图。例如"总结一篇论文的结构"对应思维导图,"描述下单支付的流程"对应流程图,"讲解登录模块中用户、前端、后端之间的调用"对应时序图。

三、三种图型的输入语法规范

选择格式后,模型必须按各自规定的语法构造输入,再交给 Action 生成。这是整个提示词中技术含量最高的部分。

3.1 时序图:精简的消息行语法

提示词原文规定:

Participant A -> Participant B: Message

即每个交互用一行参与者A -> 参与者B: 消息内容表示。这种"参与者 + 箭头 + 冒号消息"的写法与 Mermaid 时序图(sequenceDiagram)的消息行语法一致,其中->表达一条实线连接、消息文本跟在冒号后。

同时有一条例外禁令:

Do not use Alts or Notes in the sequence diagram.

即禁止使用 Alt 块(条件/分支片段)与 Note(旁注)。在 Mermaid 的 sequenceDiagram 中,alt用于表达 if/else 分支交互,Note用于在参与者旁添加注释。提示词明确禁掉这两者,说明 Whimsical 的时序图生成接口对它们的解析并不稳定,或为了保证图的简洁可读而刻意收敛语法子集。实践中这意味着:复杂条件交互应拆分为多条并列的消息行,而非嵌套的 alt 片段。

3.2 思维导图:Markdown 无序列表 + 标题

提示词要求以 Markdown 项目符号列表(bulleted format)发给 Whimsical,并给出示例:

Title: Main topic - Topic 1 - Subtopic 1-1 - Subtopic 1-1-1 - Topic 2 - Topic 3

规则可以总结为三点:

  1. 首行用Title: 主主题声明根节点;
  2. 各级子主题用-无序列表表达;
  3. 缩进即层级:两个空格的缩进对应思维导图中向下一层的分支,示例中Subtopic 1-1-1即Topic 1 → Subtopic 1-1 → Subtopic 1-1-1的三级嵌套。

这与 Whimsical 支持从 Markdown 大纲直接生成思维导图的输入习惯一致,模型只需把思维导图结构序列化成缩进列表即可完成"概念 → 图"的转换。

3.3 流程图:Mermaid 语法 + 两条硬性约束

流程图是唯一要求使用 Mermaid 语法直出的格式,示例:

graph TD A[Start] --Connection--> B[End]

其中graph TD声明自上而下(Top-Down)的有向图;A[Start]使用方括号节点;--Connection-->表达一条带标注的连接边(标准 Mermaid 中箭头写作-->,带文字的边写作-- 文字 -->)。提示词还提出两条硬性要求:

  1. 流程图应尽可能包含多个分支(multiple branches)。这与"突出决策点及其结果"的适用场景呼应——只有分支才能体现决策路径,避免退化成一条直线的步骤清单;
  2. 避免在 Mermaid 中使用括号,否则渲染会报错(原文:Avoid using parentheses in the mermaid as this will cause an error when rendering the diagram)。

第二条是实战中最易踩的坑:在 Mermaid 流程图语法中,括号本身是语法符号(如A(Start)表示圆角节点),节点文本里出现未转义的括号会干扰解析器,导致整图渲染失败。因此模型在构造流程图时必须把文本中的括号改写为引号或省略,这也说明提示词对"语法有效性"的重视高于文本原样保留。

四、生成工作流与 Action 处理协议

提示词最后一段定义了完整的执行链路,可还原为如下步骤:

  1. 告知格式:向用户说明本次选择的可视化格式;
  2. 调用 Action:按对应语法构造内容并调用 Whimsical 生成接口;
  3. 渲染图片:Action 响应中会包含图的图片,将其作为图片渲染给用户;
  4. 附编辑链接:在图片下方展示链接,链接文案必须严格为整句"View or edit this diagram in Whimsical.",整句话即链接本体,且不得附带任何其他文字;
  5. 错误恢复:若收到 Whimsical 返回的错误,应修订图形内容并确保语法有效后重试。

值得注意的细节有三处:

  • 链接文案的精确性要求:提示词明确 "The entire sentence should be a link. Don't include any other text.",即链接文本、格式、句号都必须原样保留,不允许模型自由发挥或追加引导语。这是典型的"交互规范固定化"设计,保证用户在任何一次生成后都能得到一致的编辑入口。
  • "Action" 的含义:这里的 Action 指 GPT 的 Custom Actions(通过 OpenAPI 描述文件接入的第三方 API)。提示词约定了响应契约——响应中同时携带图片与可编辑链接,模型只负责"渲染图片 + 输出链接",真正的绘图能力由 Whimsical 服务端完成。
  • 错误即重写:错误处理不是重试同一输入,而是要求"修订图并确保语法合法"。这与 3.3 节"避免括号"的约束互为表里,说明 Whimsical 对输入语法是严格校验的,模型必须承担语法修复职责。

五、复刻要点:在自己的 GPT 中实现同等能力

抛开具体实现,这份提示词本身就是一套可迁移的"绘图 GPT"设计模板。若要在自己的 GPT 中复刻,需要对齐以下五个要素:

要素复刻要点对应提示词证据
格式决策用白名单场景枚举约束模型的选型,而不是交给模型自由发挥三种格式的适用场景列举
语法契约为每种格式定义最小、确定的输入语法(Markdown 列表 / 消息行 / Mermaid 子集)各格式语法段落
渲染规避明确告知渲染引擎的已知缺陷(如 Mermaid 括号、时序图 Alt/Note)"Avoid using parentheses"、"Do not use Alts or Notes"
Action 响应契约约定响应必须包含图片与编辑链接,模型只做展示"Action response will contain an image...and a link to edit"
错误自愈收到错误时先修订语法再重试,而不是原样重发"revise the diagram and make sure the syntax is valid"

实际操作层面,可以在 GPT Builder 中通过 Actions 配置 OpenAPI 描述文件,将 Whimsical 的图形创建/编辑接口暴露给模型;随后把本文第三节的语法规范、第四节的展示协议写进系统提示词即可。需要特别强调的是:格式选择必须前置告知、Action 调用必须后置于告知之后(原文顺序为 "After telling the user the picked format, call the action to generate it"),这一先后顺序直接决定了用户体验的一致性。

六、小结

Whimsical Diagrams 的提示词是一份"小而精"的工程化样例:它用极少的篇幅同时约束了模型的决策逻辑、输入语法与工具调用协议。其核心经验可概括为三点:

  1. 用场景枚举代替自由发挥:三种格式的适用场景被明确写死,模型的选型因此稳定可预期;
  2. 用语法子集换取渲染成功率:时序图禁 Alt/Note、流程图禁括号,都是在为第三方渲染引擎"排雷";
  3. 用固定交互协议保证体验一致:先告知格式、再调 Action、图片下固定链接文案、出错即修订重试。

本文内容以仓库中的 prompts/Whimsical Diagrams.md 提示词原文为事实依据,并结合 README.md 的收录信息进行定位;文中涉及 Whimsical 私有 API 的实现细节以"推断"语气表述,未作超出证据的断言。开发者可直接将本文第二节的选择规则与第三节的语法规范作为自己绘图 GPT 的提示词骨架。

  • 提示工程

【免费下载链接】GPTs

leaked prompts of GPTs

项目地址:https://gitcode.com/GitHub_Trending/gp/GPTs
点击查看免费下载

相关推荐

上一篇:NVIDIA Profile Inspector:解锁显卡隐藏性能的终极指南
下一篇:HyperFrames scroll-feed 组件深度解析:用确定性动画打造无缝循环的"刷屏"信息流

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询