qiaomu-codex-imagegen 乔木 Codex 生图 — 让任何 Agent 都能调 Codex 生图|24 类模板 48 预设

qiaomu-codex-imagegen 是一个软件工具,把 OpenAI Codex 内置的生图能力接出来,做成 MCP 服务、命令行和 Agent Skill 三件套,共用同一套核心。Claude Code、Codex、Cursor,或者任何能执行命令的 Agent,都能说一句「做一张小红书配图」就拿到图片文件。作为一个 Skill工具,它把「选场景、选风格、写描述、验收」这套设计方法论固化成了 Agent 可调用的工具。

场景痛点

让 AI 出张封面,它给你的永远是一张 generic 的概念图:没有标题留白、没有版式逻辑、几个方向看起来就是同一张图换个滤镜。你说了要设计感,它给了你一堆词。做设计工具这一行的人都懂,AI 直接出图最大的问题不是画不好,是没有「先想清楚再画」这一步。

主要功能特点

先给方向,再出图

对 Agent 说「给这期视频做封面」,它不会直接画。第一步 suggest_directions 给出至少四个机制各异的方向:文字主导、平面结构、摄影人物、产品近摄、材料空间,再加一个 Mondo 设计师方向,每个带风格锁和参考缩略图。你选一个、几个,或者说「你定」。这一步免费、即时。

24 类模板 48 个预设

内置巨字与微小叙事、物象破框、中央光隙、东方水墨、纸雕地貌、民艺撞色、棚拍与环境与婚礼肖像、食品饮品近摄、科技轨道、巨物微缩、建筑制图、框景、文博材质、九宫格、演示、科普信息卡、日签等 24 类。每类带风格锁、可替换变量、失败条件和验收项。这不是「给你几个关键词」,是把设计方法拆成了可填的槽位。

20 位 Mondo 海报设计师风格

Olly Moss、Saul Bass、Martin Ansin、Tyler Stout、Kilian Eng、Drew Struzan 等 20 位海报设计师的风格被整合进来,再加 66 种通用风格(水彩、纸雕、等距、像素、低多边形……)。同个主题让三个设计师各来一张,出来的不是同一张图换滤镜。

场景预设自带安全区

小红书 3:4、视频横版封面 16:9、竖版 9:16、公众号头图 2.35:1、X 封面 5:2、朋友圈 4:5、电影海报 2:3、书籍专辑封面、文章科普配图,每个预设都带比例和安全区规则——竖屏封面顶部 12%、底部 20% 留给界面。做自媒体配图的人不用自己算边距。

图生图和防编造规则

参考图改图(–ref):保持主体不变,只换背景或局部。提示词里带一套防止编造事实、乱写文字的规则——图里文字要逐字给,肖像保持无字,小字号信息行可能有瑕疵要放大检查。这种对图片处理细节的较真,比让 Agent 自由发挥稳。

MCP + CLI + Skill 三件套

MCP 服务暴露七个工具(suggest_directions、compose_prompt、generate_image、search_prompts、get_prompt、build_prompt、list_catalog);CLI 一条命令直接出图;Skill 让任何支持 Agent Skills 的工具学会怎么用。在跨平台应用这条线上,它不绑死某一个 Agent,谁都能调。

能做什么

你说它做
给这期视频做一张 16:9 视频封面选 video-cover:缩略图逻辑、标题留白,用你指定的风格生成,返回文件路径和像素尺寸
做一张小红书配图,主题清晨读书选 xiaohongshu:3:4 竖版,视觉重心偏上,顶部留标题位
用 Mondo 风格做《沙丘》海报,三个设计师各来一张三个设计师风格并行生成,各自保存
把这张图的背景换成米色纸,主体不变参考图改图(图生图)
公众号头图、X 封面、朋友圈海报、书籍封面、专辑封面各有预设比例和安全区
给我几个风格 / 帮我选个风格四个以上机制不同的方向,附参考缩略图,选定后出图
找一下以前类似的案例在本地 689 条参考提示词里检索,给出缩略图与原文

简易使用教程

在实用软件里,它属于「先装 Codex CLI 再装它」那一挂:

  • 前置:Node.js 18+、已登录的 Codex CLI、Codex 账号能生图(先在 Codex 里手动生成一张确认)。
  • Skill 方式:npx skills add joeseesun/qiaomu-codex-imagegen。
  • MCP 方式:claude mcp add –scope user qiaomu-codex-imagegen — node /绝对路径/scripts/mcp-server.mjs。
  • CLI 方式:git clone 后 node scripts/cli.mjs “窗边翻开的书” –preset xiaohongshu。
  • 想先看方向不花钱:node scripts/cli.mjs suggest “咖啡店阅读活动” –for 视频封面。

个人使用感受

我用下来最直接的感受是「它把设计流程教给了 Agent」。以前让 AI 出图,是我直接写一段提示词扔进去,它画完我不满意再改,来回好几轮;这个工具强制走「推荐方向→我选→展开提示词→生成→对着验收条件检查」这条链,每次出图旁边还留一份 JSON 记录实际提示词,方便复现和做系列。24 类模板里那些「巨字与微小叙事」「物象破框」不是花架子,是真的把海报设计的机制拆成了可填的槽位。

也得说清它的门槛:它不是独立生图模型,底层调的是 Codex 内置生图,所以你得先装好 Codex CLI 并能登录;出图本身走 Codex 账号额度,不是本地免费跑;24 类模板是从 689 条公开记录提炼的机制和变量,不是复刻原图;图内小字号文字仍可能有 AI 通病瑕疵,正式用要放大检查。但如果你已经在用 Codex 或 Claude Code、又受够了 Agent 直接出图那种 generic 概念感,这个把 AI应用做成「先想清楚再画」的开源工具,值得放进你的工具推荐清单,归在AI工具和图片分类下。它没替你做设计决策,只是让你说一句「做张配图」之后,终于能在四个方向里挑一个,而不是在十张 generic 图里碰运气。

官方网站

GitHub 访问

下载地址

https://pan.quark.cn/s/e5720895968c

https://www.guangyapan.com/s/1954742759436562472_aeWhI5wocgzRgCO6 (光鸭新用户注册福利:永久免费空间:所有新用户注册即可解锁 2TB 永久免费存储空间,无需额外任务或付费)

相关推荐

Avatar photo

JameCling

我是 格律诗的软件世界 的作者,一名专注于软件工具、AI 技术和数字效率领域的独立研究者。
多年来,我持续关注互联网工具的发展趋势,体验不同平台的软件产品,并研究它们如何帮助用户提升效率。
我的工作不仅是整理软件信息,而是通过实际测试、功能分析和使用场景研究,帮助用户判断一个工具是否真正值得使用。
格律诗的软件世界 的每一篇文章都希望提供真实、有价值的信息,包括工具特点、使用方法、优缺点分析以及适合的人群。
我相信,好的工具能够改变工作方式,而准确的信息能够帮助用户做出更好的选择。