AI 文生图怎么做?新手跟着这几步就能出图
打开文生图应用,把想要的画面写成一段描述,选好比例和清晰度,点生成,5 到 30 秒就能拿到一张图。整个过程一共六步,每一步该点什么、屏幕上会出现什么,下面按顺序讲清楚。
先说结论
- 核心动作只有一个:把画面描述写清楚,其余都是选择题
- 六步流程:打开应用 → 写描述 → 传参考图(可选)→ 选比例 → 选清晰度 → 点生成
- 出图耗时约 5-30 秒(来源:应用接口公示参数),一次产出 1 张
- 比例共 11 种:手机壁纸选 9:16,横版封面选 16:9,方图选 1:1,拿不准选"自动"
- 清晰度三档:1K(默认)、2K、4K,日常屏幕用图选默认即可
- 不满意就改描述重新生成,这是正常流程,不是你操作错了
开始前:它和别的做法差在哪
| 做法 | 投入方式 | 多久能拿到图 | 需要什么基础 | 适合谁 |
|---|---|---|---|---|
| 自己学画 | 长期练习投入 | 以月、年计 | 美术功底 | 想把绘画当职业的人 |
| 找画师约稿 | 按项目付费 | 数天到数周 | 能说清需求 | 要求高的正式项目 |
| 图库网站找图 | 订阅授权 | 选好即用 | 会搜关键词 | 要通用素材的人 |
| AI 文生图 | 按需生成 | 单张约 5-30 秒 | 会打字描述 | 高频小量用图的人 |
数据来源:生成耗时来自应用接口公示参数(5-30 秒/张);其余为行业常见情况的定性描述。具体计费各渠道不同,本文不讨论具体金额。
第一步:打开应用
打开智豆AI 网站,进入应用库的"图片生成"分类,找到「Banana-Fast 文生图 | 快速生成高质量图片」,点进去就到了操作页。
你会看到:页面上有一个大的输入框(图片描述),旁边或下方是参考图片上传位、两个下拉选择框(图片比例、图片大小),以及一个生成按钮。
第二步:图片描述怎么写?(关键一步)
在"图片描述"框里,用中文把你想要的画面讲清楚。推荐按"主体 + 场景 + 光线 + 风格"的顺序写。作品中心里一条真实记录是这么写的:"泰国榴莲采摘园,美女站在榴莲树下,手持刚摘下的榴莲,面带微笑介绍,阳光照射,热带果树成林……电影感构图,真实摄影风格"——主体、动作、环境、光线、风格一次说全,所以一次就出到了接近预期的图。
你会看到:输入框里显示你打的文字,没有字数上限提示也不用担心格式,整段中文直接粘进去就行。
第三步:上传参考图(可选)
如果你手头有一张想参照的图(构图、人物或场景),点"参考图片"上传。作品中心的 5 条真实记录里有 2 条带了参考图,其中一条的描述只有一句"帮我把这张图片优化放大"。要提醒的是:它的本质是参考你的图重新画,不是修图工具,输出与原图的还原程度要自己逐张核对。
你会看到:上传后出现图片缩略图,表示参考图已就位;不传也完全可以,5 条记录里有 3 条就是纯文字描述出的图。
第四步:选图片比例
下拉框里共有 11 种比例:自动、1:1、16:9、9:16、4:3、3:4、3:2、2:3、5:4、4:5、21:9。手机壁纸和短视频封面选 9:16,公众号头图选 2:3 或 3:4,横版封面选 16:9,超宽横幅选 21:9,拿不准就保持默认的"自动"。作品中心的记录大多选了 9:16 竖图。
你会看到:选中后下拉框显示你选的比例名称,例如"9:16 竖屏"。
第五步:选图片大小(清晰度)
三档:1K 标准清晰度(默认)、2K 高清、4K 超高清。日常屏幕看图,默认 1K 就够;要打印或大幅面展示,再选 2K 或 4K。作品中心的 5 条公开记录全部用的是 1K。
你会看到:下拉框显示"1K 标准清晰度"之类的字样,选完这一步,所有输入就齐了。
第六步:点生成,等结果
点生成按钮,然后等 5-30 秒。
你会看到:页面短暂处理后出现 1 张成品图,可以在线预览、下载保存。不满意就回到第二步改描述——把不满意的部分(比如"构图太挤""光线太暗")反过来写进新描述,再生成一次。每次生成产出 1 张,想要多张挑选就多生成几次。
想看真实产出?参考案例在这里
以下三张均来自作品中心的公开真实任务记录,附上当时的输入方式,供你对照模仿。

第一张:纯文字描述,写了 200 多字,从人物裙装的蕾丝细节写到雕花木桌、镜子和暖色光线,9:16 竖图,1K 清晰度。长描述的还原度可以参考这张。

第二张:纯文字描述,"两只小猫作为夜市摊主,摆摊卖烤年糕,人类顾客排队等待……灯笼灯光暖色……电影级光影,色彩鲜艳"。奇幻场景不需要参考图也能出效果。

第三张:带参考图的记录,描述如第二步所示,比例选了"自动"。做商品场景图可以照这个思路写。
我实际试下来的感受
我没有实际跑生成,而是把作品中心里这款应用的 5 条真实任务记录从输入参数到输出图片完整翻看了一遍。总体上,中文描述的可用度比预想高,长描述基本能逐项落实到画面里。
不足有三点,写出来免得你预期错位:一是短描述不可控,有一条记录只写了"美少女战士"四个字,出图效果全凭模型发挥;二是一次只出 1 张,5 条记录无一例外,批量出图要靠多次生成;三是人物一致性做不到,两次生成之间人物长相会变,想做同一主角的系列图会吃力。
常见问题
Q1:描述有字数要求吗? 没有硬性字数要求,作品中心既有 200 多字的长描述,也有 4 个字的短句,都出过图。
Q2:参考图必须传吗? 不必。5 条公开记录里有 3 条是纯文字描述生成的,参考图只在想参照已有画面时才需要。
Q3:出的图能保存到手机吗? 能。生成结果支持在线预览和下载,手机浏览器长按图片即可保存,流程与电脑一致。
Q4:等了很久没出图怎么办? 正常耗时 5-30 秒,偶尔网络波动会慢一些,可刷新页面查看任务状态后重试一次。
写在最后
整个流程没有一步需要绘图基础,难的只有"把画面讲清楚"这一件事,而这恰恰是练两三次就能上手的事。你可以在智豆AI(zhidou.xin)的应用库里找到这款文生图应用,照着上面六步走一遍,半分钟后你就有自己的第一张 AI 图了。
用智豆AI,把上面的思路变成作品 👉
立即去创作