promptfigure-apilisted
Install: claude install-skill zhangmask/promptfigure-skill
# promptFigure 出图技能
把一句大白话变成可直接放进论文的科研图。整套管线(LLM 编排 + 提示词工程 + 审查 + 出图)都在服务端,调用方只需把**用户的绘图意图说清楚**。
**线上站点**:https://promptfigure.pages.dev
## 🔴 工作流总览:先对齐,后花钱
**整个流程里唯一花钱的动作是 API 调用**。所有迭代都在本地免费环节完成:
```
阶段 0 意图确认(对用户)→ 阶段 1 写提示词 → 阶段 2 提示词审核 → 阶段 3 API 出图
↑__________ 打回/不满意只回到这里改 prompt,免费 __________↓
```
- **阶段 0-2 强制免费前置**:意图没对齐、prompt 没过审,不准调 API。详见 `references/prompt-review-workflow.md`
- **双 Agent 模式(推荐给用户)**:Agent A(有用户上下文)写提示词,另开 Agent B 按 9 项清单审核 `handoff.json`,pass 才出图——把返工从"花钱买废图"变成"出图前两秒发现"
- 出图本身一次到位率 >> 边出边改
---
## 网页 vs API:同一个管线,少一步问询
**`/api/v1/generate` 跑的就是网页工作台那一套完整管线**——LLM 编排、意图路由、确定性净化、独立审查、出图,全部包含。**唯一区别**:
| | 网页工作台 | `/api/v1/generate` |
|---|---|---|
| 管线 | 完整 | **同款完整** |
| 交互 | 多轮问询 + 二次确认 | **一次性提交,无问询** |
| 结果 | 页面展示 + 下载 | JSON 返回 base64 PNG |
所以**「一次性答完」指的是补全用户的绘图意图,不是替服务端写提示词**。
- ✅ 正确:一次性说清「画什么图、有哪些实体、什么结构」→ 交给服务端润色扩写成完整示意
- ❌ 错误:以为没有网页问询就可以自作主张改写/增删用户意图——那会丢信息
---
## 🔴 反问边界:先澄清意图,出图过程零反问
**阶段 0(对用户)——意图不明必须主动澄清**:实体是泛称、结构推不出来、用户材料里找不到对应物时,**停下来问**,一次问完(给选项不给开放题)。这是买保险:30 秒的确认换掉 $0.15 的废图。清晰输入则回显确认卡后直接执行,不打断用户。
**阶段 3(对 API)——零反问**:出图过程不向用户追问任何参数。信息不足就从上下文推断 + 占位符补全,一次性提交。
- ❌ 禁止(任何时候):「你想画什么风格?」「用什么配色?」「比例几比几?」——按一次性收敛表推定
- ✅ 阶段 0 允许且必须:「三个模块用论文原名还是占位名?」「A→B 是单向还是有反馈?」——**只问意图级问题,一次问完**
- ✅ 阶段 3 正确:确认卡已过 → 提交 → 出图 → 不满意回阶段 1 改 prompt
完整协议(5 项意图清单 / 两档处理 / 确认卡模板)见 `references/prompt-review-workflow.md`。整文级批量任务的开工澄清(场景/模式/原始材料/档位)见 `references/figure-upgrade-workflow.md` §1。
---
## ✅ 管线状态(20