跳到主要内容
Potto AI

文生图

描述主体、构图和视觉方向,再比较生成的候选图片。

请先输入提示词

试试示例

一条提示词,一处修改:比较两张文生图结果

同一条描述笔记本、杯子和手机的文生图提示词,运行两次,只改变光线方向。

窗边木桌上放着合拢的笔记本、陶瓷杯和手机,光线从左侧照入
左侧来光
窗边木桌上放着皮面笔记本、马克杯和手机,光线从右侧照入,阴影朝左
右侧来光

保留了什么

两条提示词都指定了相同的合拢笔记本、陶瓷杯、屏幕朝下的手机和木桌,采用宽幅构图并在左侧留白。这些指令没有改变,但每次生成都会重新描绘物体,所以两张图片中的笔记本、杯子和桌子各不相同。小细节仍可能变化,因为生成并非逐像素一致的实验。

改变了什么

只改变光线:第一张是左侧柔和窗光,第二张是右侧低角度暖光。阴影朝向相反,杯子与桌面的视觉关系也随之变化。你要比较的就是这一处差异。

检查什么

检查笔记本上是否意外出现文字、手机是否反射出屏幕内容,以及是否多出杯子。然后判断这次修改是否解决了问题,例如材质是否更容易辨认。记录其他差异,不要将它们全部归因于光线指令。

适合三种展示位置的文生图提示词

每条文生图提示词都说明一个主体、一个视角,以及版式需要的空间。

绿色茶壶和一个杯子放在浅色桌面右侧,柔光从左侧照入,左侧空白留给标题

16:9 · 文章头图

讲述产品故事的静物图

选一个主体和两三个辅助物体,再说明摆放位置。绿色茶壶和一个杯子放在浅色桌面右侧,柔光从左侧照入,便能为左侧标题留白。在提示词中写清这些,而不是添加更多道具。检查物体有没有互相融合。

三组纸卡在桌面上依次排列,画成简洁的杂志风插画,无文字标签

4:3 · 文章卡片

为抽象主题配的文章与杂志插画

抽象主题首先需要一个视觉想法,再考虑长提示词。桌上三组纸卡按顺序排列,在卡片尺寸下也容易看懂;五种象征含义却未必。要求简洁形状、单一运动方向和无文字标签,再检查各组卡片显得有序还是杂乱。

明亮纸灯笼位于 4:5 竖幅画面上半部,下方整洁留白以便添加文字

4:5 · 社交帖子

经得住裁切的社交卡片

先确定一个主体和一个想法,再按展示位置选择比例。明亮纸灯笼位于竖幅画面上半部,下方整洁留白,便于之后加文字,这能告诉生成器重点在哪里。按实际展示尺寸测试裁切,并在自己的排版工具中添加活动详情。

如何使用文生图

在上方创作卡片中完成三步。

  1. 1. 写出场景

    在最多容纳 4,000 字符的提示词框中,写出围绕一个主体及其环境的文生图提示词。说明视角、光线和版式需要的空间。文字必须精确时,计划之后在自己的版式中添加,因为模型直接生成在图片里的文字需要逐字检查。

  2. 2. 选择模型与画幅

    在文生图生成器中选择 Nano Banana 或 Nano Banana Pro,再选择画面比例、HD、2K 或 4K、1 张、2 张或 4 张输出,以及 PNG 或 JPEG。先设比例,因为同一场景在方形和宽幅中会有不同布局。只有文字不足以表达时,才添加参考图。

  3. 3. 生成并比较

    单张 Nano Banana HD 图片为 23 积分,单张 Nano Banana Pro HD 图片为 45 积分;修改模型、分辨率或数量,会改变「生成」按钮显示的报价。按原尺寸检查整体构图和一处关键细节,然后下载,或修改一个选项后重试。

文生图生成器如何理解提示词

文字提示词能控制的四个方面,以及如何在结果中逐一检查。

  1. 01

    描述场景,而不只是风格标签

    文生图提示词写清一个主体、位置和周围环境时,效果通常更好。「浅色桌面上的绿色茶壶和一个空杯」给模型提供了可以安排的内容,一串形容词则没有。提示词框有足够空间写细节,无需写成长篇文字。

    • 先写一个主体及其环境
    • 补充主体旁的细节,不写冗长清单
    通过文字提示词生成的绿色茶壶和一个空杯,放在浅色桌面上
    单主体静物提示词
  2. 02

    设定光线与相机位置

    光线与视角对画面的影响往往比增加物体更大。左侧柔和窗光、低角度视角,或一侧留白的宽幅构图,都能为文生图生成器提供明确方向。每次只改一项,通过对比结果看清每条指令的作用。

    • 写明光线方向与柔和程度
    • 说明哪里需要留白
    同一条文生图提示词的两个结果,分别从相反方向打光
    同一条提示词,只将光线移到另一侧
  3. 03

    先选择比例和分辨率

    生成前选择画面比例与分辨率。相同场景在竖幅、方形和宽幅中需要不同布局,因此应按用途设比例。每次修改后,「生成」按钮上的报价都会更新。

    • HD 至 4K 分辨率
    • 可选 1 张、2 张或 4 张图片
    同一文生图场景分别按宽幅、方形与竖幅比例布局
    同一场景适配宽幅、方形与竖幅
  4. 04

    文字不够表达时,再添加参考图

    文生图从文字开始;需要匹配真实物体或特定外观时,可添加最多 14 张参考图。在提示词中说明每张参考图的用途。未附加参考图时,结果只根据提示词生成。

    • 每次请求最多 14 张参考图
    • 说明每张参考图的作用
    创作卡片中,提示词框旁边的参考图槽位
    在提示词旁添加的参考图

继续探索 Potto AI

根据图片下一步的需要,选择对应页面。

文生图常见问题

  1. 什么是文生图?

    文生图是仅根据文字描述生成图片。无需上传参考图,提示词就能设定主体、构图、光线与表现方式。Potto AI 是一款文生图 AI 生成器,使用你选择的模型与设置制作图片,供你检查和下载。提示词指明创作方向,但不保证每条指令都精确呈现。

  2. 实用的图片提示词应包含什么?

    文生图提示词应包含可见主体、主体与环境的关系、构图,以及适合展示用途的表现方式。写明相关限制,例如主体旁边留出整洁空间。避免互相冲突的要求和无法看见的细节。下一次修改应针对一个可观察的问题。

  3. 可以在图片中生成准确的文字吗?

    可以要求生成文字,但完成后要逐字核对,并检查可读性。准确的姓名、日期、标签或较长文案,适合在检查后的图片上通过排版叠加可编辑文字。生成图片不是可编辑文本文档,更高分辨率也不能证明文字正确。

  4. 生成前可以选择哪些设置?

    可以选择模型、画面比例、HD、2K 或 4K、1 张、2 张或 4 张输出,以及 PNG 或 JPEG。提示词最多 4,000 字符。先设比例,因为同一场景在方形和宽幅画面中会采用不同布局。输出尺寸由模型服务管理,用于尺寸要求严格的版式前,请检查下载文件大小。

  5. 图片接近预期但仍有问题,如何修改?

    先指出一个问题:主体太小、背景太杂、光线太硬或表现方式不对。然后只修改对应指令,保留文生图提示词的其余部分。如果物体正确但相互关系不对,就重写哪个物体在前、哪个动作最重要。生成不是逐像素控制的实验,因此也要记录其他差异,不要将它们全部归因于这次修改。

  6. 文生图能准确呈现真实产品或人物吗?

    不能稳定保证。文生图提示词创造的是想象场景,不能证明其中物体符合某件实物的形状、颜色、尺寸或材质,文字描述的角色也可能在不同图片间发生变化。真实物品或人物很重要时,应添加参考图,并将每个结果与原图对比。参考图或指定模型都不能锁定身份特征。

  7. 使用文生图需要账号吗?

    登录前可以输入提示词,并选择模型、比例和分辨率。点击「生成」会打开登录弹窗,登录时文生图提示词与设置都会保留。

  8. 文生图请求失败怎么办?

    任务会说明停止原因并提供重试;失败或取消的请求会释放预留积分。需要停止进行中的请求时,请使用取消控件,离开页面不会停止任务。图片完成后重写提示词会发起新的付费请求。

  9. 文生图需要多少积分?

    每张图片使用 Nano Banana Pro 的 HD 或 2K 档位消耗 45 积分,使用 Nano Banana 的 HD 档位为 23 积分;4K 或更多图片会消耗更多积分。确认前,「生成」按钮会显示当前设置的准确总额。

Potto AI

把文字变成图片

描述主体、光线和版式需要的空间,下载前先比较结果。