我开源了一个Skill:让AI成为画出这张图的人…

admin 2026-09-27 04:22:19 网络安全文章 来源:ZONE.CI 全球网 0 阅读模式

文章总结: 本文介绍作者开源的VisualArchaeologySkill,它能将参考图逆向还原为创作过程,生成锁死风格材质的生图Prompt。通过四个案例展示效果,区别于传统反向提示词,它关注创作过程而非画面描述。项目已开源,支持多种Agent工具,可快速部署使用。 综合评分: 75 文章分类: AI安全,安全工具,其他


我开源了一个 Skill:让 AI 成为画出这张图的人…

原创

Orisynth AI Orisynth AI

Orisynth AI

2026年9月25日 08:24 辽宁

在小说阅读器读本章

去阅读

在公众号小说中沉浸阅读

01为什么我做了这个 Skill

现在随便一个 AI,都能对着一张图说出:“这是一张复古海报,红色背景,一个女孩。”描述得又准又全,连颜色、构图、情绪都帮你标好。

可真把这句话丢给生图模型照着画,结果往往差强人意——好看是好看,但总差着那股“味儿”。

差在哪?我后来慢慢想明白:我们让 AI 描述的是“画面上有什么”,而一幅画真正值钱的地方,是它“怎么被画出来的”。

线条是悬腕勾出来的铁线描,还是数码笔刷的机械圆滑?颜色是矿物颜料一层层罩染上去,还是软件里的渐变填充?纸张是粗糙的冷压纸,还是光滑的塑料质感?

这些“创作过程”,恰恰是旁观者式的描述永远够不到的地方。而它,才是一张图“像不像手工”的真正关键。

所以我做了 Visual Archaeology——一个专门把参考图,逆向回“那位画师亲手创作的过程”的开源 Skill。

02Visual Archaeology 到底在做什么

一句话:它拿到一张参考图,不急着描述画面,而是戴上放大镜,观察颜料与纤维的微观咬合,代入那位创作者,重建整套创作流程,最后输出能锁死风格材质的生图 Prompt。

它的路径长这样:

参考图 → 视觉分析 → 创作身份 → 工具/材料/基底 → 创作过程 → 完整 Prompt

不用懂任何技术。你只要给它一张图,它会在 30 秒内给你一套“可以直接投给生图模型”的 Prompt。

03看看它实际能生成什么

这是全文的重点。我用 4 个不同画种的案例,展示它到底逆向到了什么程度。

案例 01|东方美学丝绸之路

#

#

不同于普通提示词只静态描述最终图像,逆向提示词以第一人称画家叙事,完整还原从起笔铺染到后期修改、包含媒介质感与审美禁忌的作画流程,引导AI像手绘创作一样逐步生成画面。

#

案例 02|矿泉水个性海报

#

提示词以完整实拍创作流程+材质物理细节替代单纯画面形容词,像摄影脚本,强调手工制作逻辑而非只描述结果;传统提示词大多堆砌视觉关键词,缺少制作动作、光影限制与减法构图的叙事约束。

案例 03|中国字个性海报

以创作工序顺序描述画面,强调材质触感、观看时序与情绪层次,拒绝装饰性美化;区别于传统提示词直接罗列元素,它模拟设计师实操步骤,定义观众视线流动与“近看才显现”的隐藏信息。

案例 04|矿泉水个性海报

提示词并非简单罗列画面元素,而是完整复刻文人画师分步创作逻辑,强调平面化构图、书法性笔墨与大量留白,舍弃写实透视与体积塑造,以情绪色块、稀疏点缀营造内敛孤寂的东方意境。

04它和普通图片反向提示词有什么不同?

普通反向提示词工具做的是“把画面翻译成关键词”——这张图看起来什么样。Visual Archaeology 做的是“把画面还原成一次创作”——这张图是怎么被画出来的。

拿最简单的一组对比说:

普通反向描述画面 —— Visual Archaeology重建创作过程

普通反向关注“有什么” —— Visual Archaeology关注“怎么产生”

普通反向堆风格关键词 —— Visual Archaeology拆工具、材料、手部动作

普通反向模仿视觉结果 —— Visual Archaeology追溯视觉来源

所以它的输出,从来不是一句 a beautiful illustration of a girl,而是一段第一人称、带着手部动作和物理材料的完整创作流。

我想做的,不是让 AI 更会“描述图片”,而是让它更接近那个真正创作这张图片的人。

05现在开源了,欢迎拿去玩

项目已经开源,MIT 协议,欢迎拿走、改、玩。

GitHub 仓库:https://github.com/wyx135230/visual-archaeology

怎么用(30 秒):

  1. 把整个 skill 文件夹放进你的 Agent 的 skills 目录;
  2. 给它一张参考图;
  3. 它依次输出:①媒介考古 → ②创作意识重建 → ③Visual DNA → ④⑤⑥三版 Prompt → ⑦Negative Prompt;
  4. 把 VERSION-A/B/C 和 Negative Prompt 一起投给生图模型。

支持哪些 Agent / Coding 工具:

Claude Code / Claude Skills、Codex CLI / OpenAI Agents、Cursor / Windsurf 等兼容 SKILL.md 规范的运行时,放进 skills 目录即生效,无需额外配置。

一个最简单的使用示例:

输入一张工笔重彩的参考图,Visual Archaeology 会先给出类似这样的开头——“我坐在画案前,在紧绷的熟绢底布上,用削尖的狼毫笔悬腕勾出铁线描……” 把这套第一人称物理动作 Prompt 交给生图模型,就能复刻出同一种矿物哑光与纸绢肌理。

最后留一句:它现在开源了。我也很想看看,它被别人拿去逆向之后,会产生出什么样的东西。

好的以上就是本期的内容了,感兴趣的小伙伴记得点赞收藏哦~

我是Orisynth AI,关注我,一起见证AGI时代的奇迹!


免责声明:

本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。

任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。

本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。

本文转载自:Orisynth AI Orisynth AI Orisynth AI《我开源了一个 Skill:让 AI 成为画出这张图的人…》

评论:0   参与:  0