文章总结: 本文介绍作者开源的VisualArchaeologySkill,它能将参考图逆向还原为创作过程,生成锁死风格材质的生图Prompt。通过四个案例展示效果,区别于传统反向提示词,它关注创作过程而非画面描述。项目已开源,支持多种Agent工具,可快速部署使用。
综合评分: 75
文章分类: AI安全,安全工具,其他
我开源了一个 Skill:让 AI 成为画出这张图的人…
原创
Orisynth AI
Orisynth AI
Orisynth AI
2026年9月25日 08:24
辽宁
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
01为什么我做了这个 Skill
现在随便一个 AI,都能对着一张图说出:“这是一张复古海报,红色背景,一个女孩。”描述得又准又全,连颜色、构图、情绪都帮你标好。
可真把这句话丢给生图模型照着画,结果往往差强人意——好看是好看,但总差着那股“味儿”。
差在哪?我后来慢慢想明白:我们让 AI 描述的是“画面上有什么”,而一幅画真正值钱的地方,是它“怎么被画出来的”。
线条是悬腕勾出来的铁线描,还是数码笔刷的机械圆滑?颜色是矿物颜料一层层罩染上去,还是软件里的渐变填充?纸张是粗糙的冷压纸,还是光滑的塑料质感?
这些“创作过程”,恰恰是旁观者式的描述永远够不到的地方。而它,才是一张图“像不像手工”的真正关键。
所以我做了 Visual Archaeology——一个专门把参考图,逆向回“那位画师亲手创作的过程”的开源 Skill。
02Visual Archaeology 到底在做什么
一句话:它拿到一张参考图,不急着描述画面,而是戴上放大镜,观察颜料与纤维的微观咬合,代入那位创作者,重建整套创作流程,最后输出能锁死风格材质的生图 Prompt。
它的路径长这样:
参考图 → 视觉分析 → 创作身份 → 工具/材料/基底 → 创作过程 → 完整 Prompt
不用懂任何技术。你只要给它一张图,它会在 30 秒内给你一套“可以直接投给生图模型”的 Prompt。
03看看它实际能生成什么
这是全文的重点。我用 4 个不同画种的案例,展示它到底逆向到了什么程度。
案例 01|东方美学丝绸之路
#
#
不同于普通提示词只静态描述最终图像,逆向提示词以第一人称画家叙事,完整还原从起笔铺染到后期修改、包含媒介质感与审美禁忌的作画流程,引导AI像手绘创作一样逐步生成画面。
#
案例 02|矿泉水个性海报
#
提示词以完整实拍创作流程+材质物理细节替代单纯画面形容词,像摄影脚本,强调手工制作逻辑而非只描述结果;传统提示词大多堆砌视觉关键词,缺少制作动作、光影限制与减法构图的叙事约束。
案例 03|中国字个性海报
以创作工序顺序描述画面,强调材质触感、观看时序与情绪层次,拒绝装饰性美化;区别于传统提示词直接罗列元素,它模拟设计师实操步骤,定义观众视线流动与“近看才显现”的隐藏信息。
案例 04|矿泉水个性海报
提示词并非简单罗列画面元素,而是完整复刻文人画师分步创作逻辑,强调平面化构图、书法性笔墨与大量留白,舍弃写实透视与体积塑造,以情绪色块、稀疏点缀营造内敛孤寂的东方意境。
04它和普通图片反向提示词有什么不同?
普通反向提示词工具做的是“把画面翻译成关键词”——这张图看起来什么样。Visual Archaeology 做的是“把画面还原成一次创作”——这张图是怎么被画出来的。
拿最简单的一组对比说:
普通反向描述画面 —— Visual Archaeology重建创作过程
普通反向关注“有什么” —— Visual Archaeology关注“怎么产生”
普通反向堆风格关键词 —— Visual Archaeology拆工具、材料、手部动作
普通反向模仿视觉结果 —— Visual Archaeology追溯视觉来源
所以它的输出,从来不是一句 a beautiful illustration of a girl,而是一段第一人称、带着手部动作和物理材料的完整创作流。
我想做的,不是让 AI 更会“描述图片”,而是让它更接近那个真正创作这张图片的人。
05现在开源了,欢迎拿去玩
项目已经开源,MIT 协议,欢迎拿走、改、玩。
GitHub 仓库:https://github.com/wyx135230/visual-archaeology
怎么用(30 秒):
- 把整个 skill 文件夹放进你的 Agent 的 skills 目录;
- 给它一张参考图;
- 它依次输出:①媒介考古 → ②创作意识重建 → ③Visual DNA → ④⑤⑥三版 Prompt → ⑦Negative Prompt;
- 把 VERSION-A/B/C 和 Negative Prompt 一起投给生图模型。
支持哪些 Agent / Coding 工具:
Claude Code / Claude Skills、Codex CLI / OpenAI Agents、Cursor / Windsurf 等兼容 SKILL.md 规范的运行时,放进 skills 目录即生效,无需额外配置。
一个最简单的使用示例:
输入一张工笔重彩的参考图,Visual Archaeology 会先给出类似这样的开头——“我坐在画案前,在紧绷的熟绢底布上,用削尖的狼毫笔悬腕勾出铁线描……” 把这套第一人称物理动作 Prompt 交给生图模型,就能复刻出同一种矿物哑光与纸绢肌理。
最后留一句:它现在开源了。我也很想看看,它被别人拿去逆向之后,会产生出什么样的东西。
好的以上就是本期的内容了,感兴趣的小伙伴记得点赞收藏哦~
我是Orisynth AI,关注我,一起见证AGI时代的奇迹!
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:Orisynth AI Orisynth AI
Orisynth AI《我开源了一个 Skill:让 AI 成为画出这张图的人…》