AI BASICS · 03 · VISUAL

零基础省下万元设计费:AI做图3+1招走天下

AI基本功03|做图:从“会生成”到“会控制” · 方法开源 · 2026
这一篇主要训练:提问力 × 辨识力

AI做图有一个特别有意思的悖论。

它简单到一个小孩子也能点几下生成一张漂亮图片。

可一旦你说:

“我要的不是‘随便一张好看的图’,我要这张产品图就是这个构图、这种质感、这个人物、这个品牌气质。”

难度一下子就上来了。

所以AI做图真正的分水岭,不是“会不会生成”。

而是:你能不能把脑子里那幅还不存在的画面,说清楚、控制住、改到位。

一、以前做专业图,像在背一本摄影字典

早期用AI做图时,很多人会搜一大堆提示词词典。

什么焦段、光圈、景别、侧光、逆光、构图、材质、艺术流派……甚至早期很多词还得用英文。

这其实很反人性。

一个普通用户只是想说:“我想拍一只猫坐在雨夜窗边,有一点电影感。”

结果在动手之前,先被迫读半本摄影教材。

我后来把这件事换了一个思路:

既然专业知识AI本来就知道,为什么不先造一个“摄影师”,让它把我的大白话翻译成专业语言?

二、第一招:文生图——先造专家,再造图片

第二课我们学了智能体。到了第三课,它不应该被忘掉。

可以先建立三类视觉专家:

  • 摄影师:懂光线、镜头、构图、景深;
  • 画家:懂流派、材质、色彩、笔触;
  • 设计师:懂版式、留白、视觉层级、商业表达。

以后你不必说:

“85mm镜头,f1.8,侧逆光……”

你可以先说人话:

“一只橘猫睡在阳光里的花园长椅上,我希望它看起来温暖、安静、有莫奈油画的感觉。”

再让你的“画家智能体”把这句话翻译成专业提示词。

人的任务:表达意图
AI专家的任务:翻译专业语言
生图模型的任务:执行

这就是我更喜欢的新范式:文生文,再文生图。

三、第二招:图生图——有些东西根本不值得用嘴描述

请你试着用300字,准确描述自己的脸。

很难。

再让你描述一件复杂礼服、一个特殊包装、一只自家宠物的花纹——更难。

这时候最好的提示词,可能不是文字。

而是一张图。

比如:

  • 把这件衣服穿到我身上;
  • 保留这个产品造型,换一个新的场景;
  • 保留人物身份,替换为另一种视觉风格;
  • 让我的宠物出现在一个原本不存在的故事场景里。

图生图的底层逻辑很朴素:

描述不清楚的东西,就别硬描述;把参照物直接交给AI。

四、第三招:P图与扩图——别因为一个手指错了,就推倒整栋楼

很多人AI出图不满意,第一反应是“重抽一张”。

这很像房子窗户装歪了,于是决定把房子炸掉重盖。

更成熟的工作方式,是先判断问题在哪一层:

  • 主体错了?局部替换;
  • 背景有人?局部消除;
  • 画幅太窄?扩图;
  • 只有一小块不自然?只修那一块。

这其实也是辨识力训练:

不要只会说“我不喜欢”,要能指出“具体哪里不对”。

五、+1:反推法——“高级感”这种词,AI也猜不准

当你只会说“我喜欢这种感觉”,不要继续堆形容词。可以用“偷师四部曲”把感觉拆开:

先找一张你真正喜欢的参考图,让AI反推:

  • 它的构图为什么显得高级;
  • 配色是什么逻辑;
  • 光线怎么打;
  • 背景为什么干净;
  • 材质和镜头语言有什么特点。

反推出提示词以后,保留风格、光影和构图的描述,再把主体替换成自己的产品,最后回到生图工具验证。

反推法真正厉害的地方,不是“复制别人的图”。

它是在把一句模糊的“我喜欢这种感觉”,拆成可以学习、可以迁移的视觉变量。

六、AI做图3+1,到底分别解决什么?

问题

我脑子里有画面,但说不专业

文生图:让视觉专家帮你翻译。

问题

这个人/产品/衣服,我描述不出来

图生图:直接给参照,减少猜测。

问题

大体对了,只有局部不对

P图扩图:只修错误,不推倒重来。

问题

我只知道“我喜欢”,不知道为什么

反推法:把审美拆成可描述的变量。

七、真正要练的,是“听到—看到—做到”

第三课磨课时,我们最后把一个原则说得越来越清楚:

AI课程不能只让学员“听懂”。

应该:

  • 听到:知道方法是什么;
  • 看到:看老师现场把一张图做出来;
  • 做到:马上拿自己的照片、产品、家乡、宠物去练。

因为视觉这件事,听十遍不如改一遍。

八、今天的练习:做一张“只能是你的”图

别去生成一张“宇航员在月球”“猫咪喝咖啡”这种任何人都能做的图。

选一个带有真实身份的素材:

  • 你的家乡;
  • 你的产品;
  • 你的宠物;
  • 你自己的照片;
  • 你真正喜欢的一张视觉参考。

然后至少用两种方法组合:比如先反推风格,再图生图;先让摄影师写Prompt,再局部P图。

做到最后,你应该能回答:

“这张图为什么是这样?我改了哪一个变量,所以它变好了?”

补充:第三课真正的工作流,是先造专家再做图

把文生图和智能体接在一起:先配置三位“御用画师”,以后再用大白话提出需求。

摄影师Agent

负责写实画面,把光线、镜头、构图和景深翻译出来。

画家Agent

负责艺术风格,把流派、材质、色彩和笔触组织成提示词。

设计师Agent

负责商业视觉,把版式、留白、配色、字体和视觉层级说清楚。

只做一次:配置专家 → 每次使用:说大白话 → Agent输出:专业Prompt → 生图工具执行

比如,用摄影师Agent做一瓶置于深海的金色香水,用画家Agent把“云海里的鲸鱼”变成文章封面,用设计师Agent把“618气球字”变成3D海报。重点不是记住某个词,而是让专业知识成为可调用的翻译层。

补充:三种修图动作,按问题选择

  1. 图生图:有些东西用嘴描述不清,就直接给参照图;换装、保留人物特征、迁移场景都属于这类任务。
  2. 局部重绘:主体基本正确,只修手指、路人、背景或一个不自然的局部。
  3. 外补扩展:画幅太窄、比例不对或海报没有留白,就扩大画布,让AI补出边缘。

这三步背后的判断是:不要因为局部错误,就把整张图推倒重来。先说清楚错在哪里,再选择最小修改动作。

补充:第三课的三个通关练习

不要只看演示,把同一套方法迁移到自己的素材:

  • 分别用摄影师、画家、设计师Agent完成家乡风景、专属财神和咖啡店Logo;
  • 用一张自拍做风格迁移,用局部重绘清理杂乱背景,再把大头照扩成半身职业照;
  • 找一张自己喜欢的海报,让AI反推它的风格、光影和构图,再替换成自己的主体。

通关检查不是“AI生成过图片”,而是你能说出:这次用了哪种方法,控制了哪个变量,为什么这一版比上一版更接近目标。

结尾:AI把“会画”变便宜以后,什么开始变贵?

不是提示词词典。

而是你脑子里有没有画面,你能不能看出差异,你知不知道下一步该改哪里。

AI让生成变便宜,判断就开始变贵。