
qiaomu-codex-imagegen 是一个软件工具,把 OpenAI Codex 内置的生图能力接出来,做成 MCP 服务、命令行和 Agent Skill 三件套,共用同一套核心。Claude Code、Codex、Cursor,或者任何能执行命令的 Agent,都能说一句「做一张小红书配图」就拿到图片文件。作为一个 Skill工具,它把「选场景、选风格、写描述、验收」这套设计方法论固化成了 Agent 可调用的工具。
场景痛点
让 AI 出张封面,它给你的永远是一张 generic 的概念图:没有标题留白、没有版式逻辑、几个方向看起来就是同一张图换个滤镜。你说了要设计感,它给了你一堆词。做设计工具这一行的人都懂,AI 直接出图最大的问题不是画不好,是没有「先想清楚再画」这一步。

主要功能特点
先给方向,再出图
对 Agent 说「给这期视频做封面」,它不会直接画。第一步 suggest_directions 给出至少四个机制各异的方向:文字主导、平面结构、摄影人物、产品近摄、材料空间,再加一个 Mondo 设计师方向,每个带风格锁和参考缩略图。你选一个、几个,或者说「你定」。这一步免费、即时。
24 类模板 48 个预设
内置巨字与微小叙事、物象破框、中央光隙、东方水墨、纸雕地貌、民艺撞色、棚拍与环境与婚礼肖像、食品饮品近摄、科技轨道、巨物微缩、建筑制图、框景、文博材质、九宫格、演示、科普信息卡、日签等 24 类。每类带风格锁、可替换变量、失败条件和验收项。这不是「给你几个关键词」,是把设计方法拆成了可填的槽位。
20 位 Mondo 海报设计师风格
Olly Moss、Saul Bass、Martin Ansin、Tyler Stout、Kilian Eng、Drew Struzan 等 20 位海报设计师的风格被整合进来,再加 66 种通用风格(水彩、纸雕、等距、像素、低多边形……)。同个主题让三个设计师各来一张,出来的不是同一张图换滤镜。
场景预设自带安全区
小红书 3:4、视频横版封面 16:9、竖版 9:16、公众号头图 2.35:1、X 封面 5:2、朋友圈 4:5、电影海报 2:3、书籍专辑封面、文章科普配图,每个预设都带比例和安全区规则——竖屏封面顶部 12%、底部 20% 留给界面。做自媒体配图的人不用自己算边距。
图生图和防编造规则
参考图改图(–ref):保持主体不变,只换背景或局部。提示词里带一套防止编造事实、乱写文字的规则——图里文字要逐字给,肖像保持无字,小字号信息行可能有瑕疵要放大检查。这种对图片处理细节的较真,比让 Agent 自由发挥稳。
MCP + CLI + Skill 三件套
MCP 服务暴露七个工具(suggest_directions、compose_prompt、generate_image、search_prompts、get_prompt、build_prompt、list_catalog);CLI 一条命令直接出图;Skill 让任何支持 Agent Skills 的工具学会怎么用。在跨平台应用这条线上,它不绑死某一个 Agent,谁都能调。

能做什么
| 你说 | 它做 |
|---|---|
| 给这期视频做一张 16:9 视频封面 | 选 video-cover:缩略图逻辑、标题留白,用你指定的风格生成,返回文件路径和像素尺寸 |
| 做一张小红书配图,主题清晨读书 | 选 xiaohongshu:3:4 竖版,视觉重心偏上,顶部留标题位 |
| 用 Mondo 风格做《沙丘》海报,三个设计师各来一张 | 三个设计师风格并行生成,各自保存 |
| 把这张图的背景换成米色纸,主体不变 | 参考图改图(图生图) |
| 公众号头图、X 封面、朋友圈海报、书籍封面、专辑封面 | 各有预设比例和安全区 |
| 给我几个风格 / 帮我选个风格 | 四个以上机制不同的方向,附参考缩略图,选定后出图 |
| 找一下以前类似的案例 | 在本地 689 条参考提示词里检索,给出缩略图与原文 |

简易使用教程
在实用软件里,它属于「先装 Codex CLI 再装它」那一挂:
- 前置:Node.js 18+、已登录的 Codex CLI、Codex 账号能生图(先在 Codex 里手动生成一张确认)。
- Skill 方式:npx skills add joeseesun/qiaomu-codex-imagegen。
- MCP 方式:claude mcp add –scope user qiaomu-codex-imagegen — node /绝对路径/scripts/mcp-server.mjs。
- CLI 方式:git clone 后 node scripts/cli.mjs “窗边翻开的书” –preset xiaohongshu。
- 想先看方向不花钱:node scripts/cli.mjs suggest “咖啡店阅读活动” –for 视频封面。

个人使用感受
我用下来最直接的感受是「它把设计流程教给了 Agent」。以前让 AI 出图,是我直接写一段提示词扔进去,它画完我不满意再改,来回好几轮;这个工具强制走「推荐方向→我选→展开提示词→生成→对着验收条件检查」这条链,每次出图旁边还留一份 JSON 记录实际提示词,方便复现和做系列。24 类模板里那些「巨字与微小叙事」「物象破框」不是花架子,是真的把海报设计的机制拆成了可填的槽位。
也得说清它的门槛:它不是独立生图模型,底层调的是 Codex 内置生图,所以你得先装好 Codex CLI 并能登录;出图本身走 Codex 账号额度,不是本地免费跑;24 类模板是从 689 条公开记录提炼的机制和变量,不是复刻原图;图内小字号文字仍可能有 AI 通病瑕疵,正式用要放大检查。但如果你已经在用 Codex 或 Claude Code、又受够了 Agent 直接出图那种 generic 概念感,这个把 AI应用做成「先想清楚再画」的开源工具,值得放进你的工具推荐清单,归在AI工具和图片分类下。它没替你做设计决策,只是让你说一句「做张配图」之后,终于能在四个方向里挑一个,而不是在十张 generic 图里碰运气。
官方网站
GitHub 访问
下载地址
https://pan.quark.cn/s/e5720895968c
https://www.guangyapan.com/s/1954742759436562472_aeWhI5wocgzRgCO6 (光鸭新用户注册福利:永久免费空间:所有新用户注册即可解锁 2TB 永久免费存储空间,无需额外任务或付费)
相关推荐
Vivid Figures 生动数据图:让 AI 用数据生成科研图表的工具|两种风格、五套配色、内置 108 个图表配方覆盖常见科研图型







