Photo-abstract-editorial:把一张照片拆成”原片 + 抽象记忆面板”的 Codex Skill

现在做 AI 修图的工具一抓一大把,绝大多数都在干同一件事:把照片重画一遍。皮肤磨平、天空换色、整张图迁移成某种风格。photo-abstract-editorial 偏偏反着来。它在 SKILL.md 里给自己定了三条死规矩:不是滤镜,不是重画,不是风格迁移。上传的照片必须原样保留,一个字都不许改。

这听着有点反直觉。一个 2026 年 8 月 4 日才创建的仓库,九天时间冲到接近 2000 Stars,靠的居然是”尽量别动原图”。它真正产出的是一张竖向编辑作品:上半部分放你那张原封不动的照片,下半部分从这张照片的空间关系、构图节奏和色彩里,提炼出一块象牙白底的极简抽象面板,最后再配一个两到五个词的原创英文标题。

Photo-abstract-editorial:把一张照片拆成"原片 + 抽象记忆面板"的 Codex Skill

我一开始看到这名字,以为又是哪个滤镜 Skill 换了个壳。翻完 SKILL.md 和两份完整 prompt 才意识到,它约束的根本不是”画面长什么样”,而是模型该理解什么、该保留什么、该删除什么。这个思路,跟市面上那些”把照片变成插画海报”的同类项目,压根不在一个层面。

说白了,这篇文章想讲明白一件事:一个连可执行代码都没有的仓库,凭什么在 Codex Skill 圈子里被疯转,它又值不值得你花五分钟装进 Codex 试一张?

为什么值得关注

最戳我的是它的抽象逻辑:关系优先,而不是轮廓优先。SKILL.md 里有句话我反复读了几遍,大意是抽象面板里的每一个重要元素,都必须能追溯到原照片里真实存在的空间、色彩或结构事实。它明确要求 prefer relationships over silhouettes,宁可保留关系,也不去描轮廓。

这两者的区别在哪。描轮廓是照葫芦画瓢,AI 很容易把地标建筑画成一个简陋的矢量图标,把人画成火柴棍。关系优先则是逼模型去回答:这张照片的轴在哪、节奏在哪、哪些颜色在对话。最后落到面板上的,是几条短条、几块色带、几根细线,抽象得几乎认不出原图,但你能感觉到它跟原图是一家人。

第二个亮点是它的护栏写得很硬。除了那三条死规矩,它还列了一串 Guardrails:面板必须平涂象牙白,禁渐变、纹理、颗粒、阴影、晕影、拼贴痕迹;人物只能保留为不规则的连续竖条或锥形块,不许出现头、四肢、脸、衣服;地标建筑最多保留一到三个辨识线索,别碰表面细节。

这套护栏的价值不在”管住模型”,在于它把”抽象到什么程度”这个最模糊的问题,变成了可复现的约束。你自己写 prompt 做抽象排版,很容易越画越像原图,最后变成半吊子插画。它直接把退路堵死了。

第三个亮点是它把整套 prompt 中英文全量公开了。references 目录下躺着两个完整文件,中文版和英文版各一份。这意味着你根本不装 Codex 也能用:直接把文件内容当图像生成提示词丢给任意模型。这也是它三天冲上 2000 Stars 的原因之一,门槛低到没有门槛。

整个生成流程可以压缩成七步,看这张图就清楚了。

Photo-abstract-editorial:把一张照片拆成"原片 + 抽象记忆面板"的 Codex Skill

从分析照片到只回成品,七步里没有一步是”美化”,全都是约束。最后一环尤其反直觉:它明确禁止对称、禁止发明装饰元素、禁止加边框和阴影。市面上大多数照片海报模板恨不得把装饰堆满,它反着做减法。这种克制,恰恰是它看起来高级的原因。

亮点归亮点,它到底怎么装、怎么跑起来,往下看。

跑起来看看

安装几乎没有成本。它不是一个 pip install 的东西,而是一个 Codex Skill。把整个文件夹复制到 Codex 的 skills 目录即可,仓库结构长这样:

photo-abstract-editorial/
├── SKILL.md                         # Skill 工作流与约束
├── agents/openai.yaml               # Codex 界面元数据
├── references/
│   ├── photo-abstract-editorial-prompt.zh-CN.md
│   └── photo-abstract-editorial-prompt.en.md
└── assets/examples/                 # 5 张示例图片

装好之后开一个新的 Codex 对话,上传一张照片,说一句人话就行:

使用 photo-abstract-editorial 将这张照片制作成
摄影与抽象面板组合的编辑作品。

看懂了目录,还得看懂它的运行逻辑。这个 Skill 最核心的一条约束,是照片永远是唯一内容来源,抽象面板里每一个色块都要能从原图追溯回来。这条内容来源链画出来长这样:

Photo-abstract-editorial:把一张照片拆成"原片 + 抽象记忆面板"的 Codex Skill

照片是唯一的输入,模型从中提炼空间、节奏、色彩三类事实,再推导出面板和标题。注意中间没有一步是风格迁移,所有抽象元素都锚定在原片的真实关系上。理解了这条链,你就明白为什么它在 Codex 上出片最稳。

这里有个必须提前说的提醒,来自 36kr 的横向评测。同一套 Skill 分别丢给 Codex、GPT 聊天版和豆包 Agent 跑,成品完成度差异明显。Codex 能理解留白、纸张肌理、单一强调色这些形态约束,GPT 只停留在整体视觉形式上,豆包甚至有一张直接没用原图、重新生成了一张雪地铁路。结论很直接,这 Skill 目前最认 Codex。

想调整也没问题。README 明确说这套提示词是高质量起点,而非不可改的版式规范。照片面板比例、象牙白背景、提取色的饱和度、抽象形式、标题字体,全都能动。但两条核心原则作者建议别碰:照片永远是唯一内容来源;面板里每个元素都要能追溯回原图。

常见的坑有两个。一是英文标题,两到五个词的英文题目对中文用户的照片可能有点割裂,你完全可以改成中文或直接关掉副标题。二是抽象程度,它对城市、旅行、展览这类照片最友好,对大头照、静物这类主体单一的照片,可提炼的空间关系偏少,效果会打折扣。问题是,它到底适合谁、什么时候不该碰?

什么时候用,什么时候别用

先给一张速览表,帮你看清它适合哪类人:

场景 典型用户 优势 局限
城市、旅行随拍 摄影爱好者、博主 保留原片再加抽象呼应 主体单一照片效果弱
展览、作品集封面 设计师、艺术家 克制的高级感 英文标题或需改写
社媒长图、杂志感排版 内容创作者 无需设计功底 强依赖 Codex 运行时
学提示词工程 AI 从业者、学生 结构化约束的活教材 非商业协议

不适用的情况同样要讲清楚:

  • 只想给照片套个滤镜、换个风格,出门右转找滤镜类工具,这个 Skill 明确不干这个,它连重画都不允许。
  • 想把成品直接用于商业项目、付费课程或客户交付,得先跟作者谈授权,仓库协议把商用这条路锁死了。
  • 手头没有 Codex,只能跑 GPT 或豆包,成品会明显掉档,效果不一定达得到示例图的水平。

适用和不适用的边界划完了,但真正决定它能不能长期用的,是社区和协议这两件事。

维护靠不靠谱

社区健康度这块得诚实说,这是个极新的项目,8 月 4 日才建仓,到今天不过九天。接近 2000 Stars 的增速确实吓人,但下面这张表能看出它有多”轻”:

指标 数据 说明
Stars 约 2000(2026 年 8 月中旬) 9 天冲量,增速惊人
核心维护者 1 人 Bus Factor 高风险
Commits 约 22 次 创建至今仍高频更新
协议 自定义保留所有权利 非商业,商用需授权

协议是这里最需要单独讲清楚的点。它用的是自定义的 All rights reserved,不是 MIT、不是 Apache。条款写得很明白:仅供个人学习、研究和非商业用途,任何商用,包括付费项目、客户项目、企业应用、付费课程、商业分发,都得先找作者授权。所以严格说,它不算传统意义上的开源,更接近”源码可见、保留权利”。

一个很真实的社区信号藏在 README 的声明里。作者原话吐槽,这几天被人抄袭,甚至有人拿这东西去卖。这种抱怨恰恰说明了两件事:一是这个 Skill 的 prompt 价值被市场快速验证了,二是这类纯 prompt 项目的护城河极薄,复制成本近乎为零。

外部评价里,掘金的一篇文章把它归进”在 Codex 中用这 4 个 Skill 让你照片变高级”的清单,给了”保留原图的抽象编辑排版”这个定位,36kr 则做了多模型横评。除此之外,目前还没有成规模的 Issue 讨论,毕竟项目太新,社区声音主要来自外部媒体而非仓库本身。不过社区聊到这里,判断才是更核心的问题。

值不值得跟

先说判断:这不是一个你能拿来当生产力依赖的项目,而是一个值得你读一遍的提示词教材。它的价值七成在 SKILL.md 和那两份 prompt 里,剩下的才是它产出的图。

它最聪明的地方,是把”抽象排版”这个靠手感的东西,翻译成了一串可验证的约束。关系优先、平涂象牙白、人物竖条化、地标三线索,每一条都是在给模型划边界。你单独看任何一条都不起眼,串起来就是一套完整的审美系统。这是纯 prompt 工程能做到的上限。

但它也有天花板。单维护者、九天寿命、非商业协议,这三点决定了你没法把它当稳定依赖。更麻烦的是,它的效果强绑定 Codex 这个运行时,换到 GPT 或豆包就掉档。这意味着它的”产品”其实是 Codex 的理解能力,不是这个仓库本身。

趋势上看,它踩在了一个正在起飞的赛道上。8 月这一波,gc-minimal-zine-poster 冲到四千多 Stars,gathered-scenes-zine-skill 一千四,photo-relic-editorial、visual-memory-translator 一批同类的都在涨。这是”照片转编辑作品”这个品类被集中验证的信号。跟这几个同类的差别,一张对比卡片比文字更清楚:

Photo-abstract-editorial:把一张照片拆成"原片 + 抽象记忆面板"的 Codex Skill

但赛道热不代表它稳。这类 Skill 的壁垒在 prompt 而非代码,作者自己都被抄到破防。头部玩家靠先发和审美积累拉开差距,后面的复制者成本几乎为零。photo-abstract-editorial 目前的差异化,全押在”关系优先”这一条哲学上,这条哲学一旦被抄走,它就没有别的护城河了。

我的态度是有保留的认可。它把对的事做了,把难的事留给了你:抽象程度的把控、标题的取舍、跟 Codex 的绑定,都是留给使用者的功课。但作为一本教你”怎么写高质量图像 prompt”的活教材,它免费、完整、中英对照,这个价值是实打实的。

资源地址

资源 地址
GitHub https://github.com/ZzzLc0405/photo-abstract-editorial

聊到这里,该给你具体的行动建议了。先说你适合动手的场景,再说你在观望时该盯什么。

先拿城市街拍试一张

如果你正好用 Codex,又有一堆城市旅行照片躺在相册里吃灰,把它装上试一张,成本就是复制一个文件夹加一句指令。从城市街道、海岸线这类空间关系丰富的照片入手,出片最稳。

如果你还在观望,盯两个信号就行。一个是作者会不会继续更版本,单维护者的生死线就在这里;另一个是”关系优先”这套哲学会不会被头部竞品吸收。前者决定它还能不能用,后者决定它还有没有独特位置。

一个连代码都没有的仓库,九天被疯转、被抄袭、被倒卖,这件事本身比它产出的任何一张图都值得想。它说明在 Codex 时代,好 prompt 正在变成一种可以估值、也可以被偷走的产品。

skills资源

Docstring:把 PyTorch 那套没人明说的文档约定,打包成一个 Skill

2026-8-15 10:15:37

行业动态

Windsurf惊魂96小时!AI闪电并购战:谷歌天价挖人,Cognition逆袭接盘

2025-7-22 15:05:37

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧