ai-image-gen · AI 生图

通用 AI 图像生成 skill,覆盖文生图、图生图、图像变体三类任务。
输入自然语言描述,输出高清图片;也可对已有图片做修改(换背景、换风格、增减元素)或批量生成变体。适用于文章配图、社媒封面、产品概念图、海报底图等日常出图场景。
支持 OpenAI 兼容接口与 apimart 异步接口,需自备 API key。
调用示例:在聊天框中说"生成一张扁平插画风的柴犬,明亮撞色背景,1024×1024"。
产品详解
定位
ai-image-gen 是 Skill 库中的通用图像生成入口:任意题材、纯 AI 生成。它不负责排版、不负责电商专用视觉,只解决"根据描述生成一张图"这件事。
核心能力
- 文生图(text2img):自然语言 prompt → 高清图片。主体、风格、构图、光线、画质五要素写法,输出可控性高。
- 图生图(img2img):输入已有图片 + 修改指令,定向调整:换背景、换风格、增减画面元素。
- 图像变体(variations):基于一张图生成多个变体,供排版时挑选。
- 双模式接入:OpenAI 兼容接口(同步)与 apimart(异步轮询)自动识别,也可手动指定。
工作流程
- 运行配置检查(
check):确认三项配置就绪,缺项即止并给出填写指引,不盲目发请求烧钱 - 将需求写成结构化图像 prompt(主体 + 风格 + 构图 + 光线 + 画质)
- 执行生成,产物写入
outputs/目录
输入与输出
| 输入 | 说明 |
|---|---|
| 图像描述 | 必填,自然语言 |
| 尺寸/数量 | 选填,如 1024×1024、一次生成 n 张 |
| 原图 | 图生图 / 变体任务必填 |
输出:PNG/JPG 图片文件,落盘于 outputs/ 指定目录。
与相邻 skill 的区别
| skill | 分工 |
|---|---|
| ai-image-gen(本) | 通用 AI 生图,任意题材 |
| ecom-details-image | 电商专用:商品主图、详情页视觉方案(25 场景模板) |
| card-quote / card-xiaohongshu / poster 系列 | HTML+CSS 确定性渲染的文字卡片/海报,非 AI 生成,胜在排版精准 |
| image-editing | 已有图片的确定性处理(改尺寸、裁剪、水印、压缩),不生成新画面 |
适用场景
- 公众号/博客文章配图、小红书封面、PPT 插图
- 产品概念图、营销海报底图、社媒视觉素材
- 需要快速出多版视觉方案供比选的策划阶段
使用前准备
- 需在项目根目录
.env配置三项:IMG_BASE_URL(API 根地址)、IMG_MODEL(模型名)、IMG_API_KEY(key,支持多组别名)。 - key 只存在于本地
.env;skill 不索要、不回显、不上传、不提交任何真实 key。 - 按量计费:先
check确认配置,再小批量试生成,确认风格符合预期后再放量。
ai-image-gen 隶属于 Aiglade Skill 库。在 Aiglade 聊天框中用自然语言描述需求即可调用。