AI Image Generator 支持上传图片或手绘草图来引导生成吗?
支持。aiimagegenerator.org 在文字提示之外,提供了一个可选的初始图片入口:你可以上传一张 PNG、JPG 或 GIF 图片,也可以直接在页面提供的绘图区域里手绘草图,用它们引导 AI 生成结果。这两项都是可选项,不上传、不画草图也能仅凭文字提示生成图片。
两种引导方式的操作与限制
上传图片作为初始参考
页面上的上传入口标注为 “(Optional) Include an image to guide the AI image generation”,即用一张已有图片作为生成的起点或参考。
- 支持格式:PNG、JPG、GIF
- 建议尺寸:512px × 512px,官方说明这个尺寸效果最好
- 大小上限:1MB
操作流程是:先填写文字提示(prompt),再通过 “Upload Initial Image” 选择本地图片,最后点击 “Generate Image”。预期结果是 AI 会结合文字提示和这张初始图片来生成新图,而不是原样返回你的图片。
手绘草图作为初始参考
上传入口下方还有一个绘图区域,说明为 “(Optional) Sketch something in this space below to provide an initial image to guide the AI image generation”。你可以直接用鼠标或触控在空白画布上画出大致构图、轮廓或色块,把它当作初始图像交给模型。
这种方式适合你脑子里有构图但找不到合适参考图的情况——比如想生成一只特定姿态的猫,先画出身体朝向和大致比例,再配合文字提示描述风格和细节。
上传或绘制之外,还能怎么控制生成结果
除了初始图片,页面还提供了三组下拉选项,可以和文字提示叠加使用:
| 选项类别 | 作用 | 可选值示例 |
|---|---|---|
| Art Style(艺术风格) | 决定整体画风 | Oil Painting、Watercolor、Digital Art、Anime、Photorealistic、Pencil Sketch、3D Render、Pixel Art、Comic Book、Art Nouveau |
| Subject(主体类型) | 引导生成对象的类别 | Abstract、Architecture、Food、Animals、Fantasy、Sci-Fi |
| Mood & Lighting(氛围与光线) | 控制情绪和光照 | Cinematic、Dramatic、Soft Glow、Neon、Moody、Vibrant、Vintage、Minimalist |
页面还给出了几个可直接试用的提示词示例:cyberpunk cowboy、elegant kitten portrait、alien planet。
常见卡点
- 图片超过 1MB 或尺寸远大于 512px:页面明确给了上限和建议值,超出可能上传失败或影响生成效果,建议先压缩、裁剪到 512px 见方再上传。
- 只上传图片、不写文字提示:初始图片是“引导”而非“替代”文字提示,配合描述性的文字提示通常更容易得到接近预期的结果。
- 把上传图当成图生图的精确复刻:它的定位是引导生成,输出是新生成的图像,不会逐像素保留原图内容。
- 格式不符:只列出 PNG、JPG、GIF 三种,其他格式(如 WebP、HEIC)未在支持范围内,使用前先转换。
如果你只是想快速试一下,可以跳过上传和手绘,直接输入文字提示并选择风格、主体、氛围后点击生成;等熟悉了输出风格,再用手绘草图或参考图去约束构图。