---
title: "文生图 AI 生成器 | Potto AI"
description: "用 Potto AI 文生图，将文字提示词变成图片。描述主体、风格与构图，选择比例和尺寸，再比较结果。"
canonical: "https://potto.ai/zh/text-to-image"
language: "zh-CN"
dateModified: "2026-10-07"
---

# 文生图

描述主体、构图和视觉方向，再比较生成的候选图片。

## 试试示例

- **笔记本静物**: 制作一张安静的静物摄影：窗边浅色木桌上放着合拢的笔记本、一个陶瓷杯和一部屏幕朝下的手机。使用柔和侧光、克制的暖色调和宽幅构图，左侧保留整洁空间。笔记本封面保持素净，不要文字。
- **排列优先级**: 简洁的文章插画：三组彼此分明的纸卡在桌面上排列成清晰顺序。使用简洁形状、克制配色和单一明确的运动方向。背景保持简净，不要文字标签。
- **纸灯笼**: 安静的傍晚背景前，一盏明亮纸灯笼位于画面上半部，下方整洁留白，方便之后添加文字。柔和光晕，克制配色，无文字。

## 一条提示词，一处修改：比较两张文生图结果

同一条描述笔记本、杯子和手机的文生图提示词，运行两次，只改变光线方向。

![窗边木桌上放着合拢的笔记本、陶瓷杯和手机，光线从左侧照入](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-left-1080.webp)

*左侧来光*

![窗边木桌上放着皮面笔记本、马克杯和手机，光线从右侧照入，阴影朝左](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-right-1080.webp)

*右侧来光*

### 保留了什么

两条提示词都指定了相同的合拢笔记本、陶瓷杯、屏幕朝下的手机和木桌，采用宽幅构图并在左侧留白。这些指令没有改变，但每次生成都会重新描绘物体，所以两张图片中的笔记本、杯子和桌子各不相同。小细节仍可能变化，因为生成并非逐像素一致的实验。

### 改变了什么

只改变光线：第一张是左侧柔和窗光，第二张是右侧低角度暖光。阴影朝向相反，杯子与桌面的视觉关系也随之变化。你要比较的就是这一处差异。

### 检查什么

检查笔记本上是否意外出现文字、手机是否反射出屏幕内容，以及是否多出杯子。然后判断这次修改是否解决了问题，例如材质是否更容易辨认。记录其他差异，不要将它们全部归因于光线指令。

## 适合三种展示位置的文生图提示词

每条文生图提示词都说明一个主体、一个视角，以及版式需要的空间。

### 讲述产品故事的静物图

*16:9 · 文章头图*

选一个主体和两三个辅助物体，再说明摆放位置。绿色茶壶和一个杯子放在浅色桌面右侧，柔光从左侧照入，便能为左侧标题留白。在提示词中写清这些，而不是添加更多道具。检查物体有没有互相融合。

![绿色茶壶和一个杯子放在浅色桌面右侧，柔光从左侧照入，左侧空白留给标题](https://cdn.potto.ai/images/text-to-image-teapot-headline-space-1080.webp)

### 为抽象主题配的文章与杂志插画

*4:3 · 文章卡片*

抽象主题首先需要一个视觉想法，再考虑长提示词。桌上三组纸卡按顺序排列，在卡片尺寸下也容易看懂；五种象征含义却未必。要求简洁形状、单一运动方向和无文字标签，再检查各组卡片显得有序还是杂乱。

![三组纸卡在桌面上依次排列，画成简洁的杂志风插画，无文字标签](https://cdn.potto.ai/images/text-to-image-paper-cards-editorial-1080.webp)

### 经得住裁切的社交卡片

*4:5 · 社交帖子*

先确定一个主体和一个想法，再按展示位置选择比例。明亮纸灯笼位于竖幅画面上半部，下方整洁留白，便于之后加文字，这能告诉生成器重点在哪里。按实际展示尺寸测试裁切，并在自己的排版工具中添加活动详情。

![明亮纸灯笼位于 4:5 竖幅画面上半部，下方整洁留白以便添加文字](https://cdn.potto.ai/images/text-to-image-paper-lantern-social-928.webp)

## 如何使用文生图

在上方创作卡片中完成三步。

### 1. 写出场景

在最多容纳 4,000 字符的提示词框中，写出围绕一个主体及其环境的文生图提示词。说明视角、光线和版式需要的空间。文字必须精确时，计划之后在自己的版式中添加，因为模型直接生成在图片里的文字需要逐字检查。

### 2. 选择模型与画幅

在文生图生成器中选择 [Nano Banana](https://potto.ai/zh/nano-banana.md) 或 [Nano Banana Pro](https://potto.ai/zh/nano-banana-pro.md)，再选择画面比例、HD、2K 或 4K、1 张、2 张或 4 张输出，以及 PNG 或 JPEG。先设比例，因为同一场景在方形和宽幅中会有不同布局。只有文字不足以表达时，才添加参考图。

### 3. 生成并比较

单张 Nano Banana HD 图片为 23 积分，单张 Nano Banana Pro HD 图片为 45 积分；修改模型、分辨率或数量，会改变「生成」按钮显示的报价。按原尺寸检查整体构图和一处关键细节，然后下载，或修改一个选项后重试。

## 文生图生成器如何理解提示词

文字提示词能控制的四个方面，以及如何在结果中逐一检查。

### 描述场景，而不只是风格标签

文生图提示词写清一个主体、位置和周围环境时，效果通常更好。「浅色桌面上的绿色茶壶和一个空杯」给模型提供了可以安排的内容，一串形容词则没有。提示词框有足够空间写细节，无需写成长篇文字。

- 先写一个主体及其环境
- 补充主体旁的细节，不写冗长清单

![通过文字提示词生成的绿色茶壶和一个空杯，放在浅色桌面上](https://cdn.potto.ai/images/text-to-image-teapot-single-subject-1080.webp)

*单主体静物提示词*

### 设定光线与相机位置

光线与视角对画面的影响往往比增加物体更大。左侧柔和窗光、低角度视角，或一侧留白的宽幅构图，都能为文生图生成器提供明确方向。每次只改一项，通过对比结果看清每条指令的作用。

- 写明光线方向与柔和程度
- 说明哪里需要留白

![同一条文生图提示词的两个结果，分别从相反方向打光](https://cdn.potto.ai/images/text-to-image-light-opposite-sides-1080.webp)

*同一条提示词，只将光线移到另一侧*

### 先选择比例和分辨率

生成前选择画面比例与分辨率。相同场景在竖幅、方形和宽幅中需要不同布局，因此应按用途设比例。每次修改后，「生成」按钮上的报价都会更新。

- HD 至 4K 分辨率
- 可选 1 张、2 张或 4 张图片

![同一文生图场景分别按宽幅、方形与竖幅比例布局](https://cdn.potto.ai/images/text-to-image-teapot-three-ratios-1080.webp)

*同一场景适配宽幅、方形与竖幅*

### 文字不够表达时，再添加参考图

文生图从文字开始；需要匹配真实物体或特定外观时，可添加最多 14 张参考图。在提示词中说明每张参考图的用途。未附加参考图时，结果只根据提示词生成。

- 每次请求最多 14 张参考图
- 说明每张参考图的作用

![创作卡片中，提示词框旁边的参考图槽位](https://cdn.potto.ai/images/text-to-image-creation-card-reference-slot-1080.webp)

*在提示词旁添加的参考图*

## 继续探索 Potto AI

根据图片下一步的需要，选择对应页面。

- [图生图](https://potto.ai/zh/image-to-image.md): 从已有参考图开始。
- [AI 照片生成](https://potto.ai/zh/ai-photo-generator.md): 描述摄影般的光线、取景与材质细节。
- [AI 绘画](https://potto.ai/zh/ai-art-generator.md): 选择媒介、配色与构图。
- [AI 角色生成](https://potto.ai/zh/ai-character-generator.md): 通过可见特征描述角色。
- [AI 修图](https://potto.ai/zh/ai-image-editor.md): 修改成品图片中的一处内容。
- [AI 生成图片](https://potto.ai/zh/ai-image-generator.md): 完整设置模型、比例、分辨率与参考图。

## 文生图常见问题

### 什么是文生图？

文生图是仅根据文字描述生成图片。无需上传参考图，提示词就能设定主体、构图、光线与表现方式。Potto AI 是一款文生图 AI 生成器，使用你选择的模型与设置制作图片，供你检查和下载。提示词指明创作方向，但不保证每条指令都精确呈现。

### 实用的图片提示词应包含什么？

文生图提示词应包含可见主体、主体与环境的关系、构图，以及适合展示用途的表现方式。写明相关限制，例如主体旁边留出整洁空间。避免互相冲突的要求和无法看见的细节。下一次修改应针对一个可观察的问题。

### 可以在图片中生成准确的文字吗？

可以要求生成文字，但完成后要逐字核对，并检查可读性。准确的姓名、日期、标签或较长文案，适合在检查后的图片上通过排版叠加可编辑文字。生成图片不是可编辑文本文档，更高分辨率也不能证明文字正确。

### 生成前可以选择哪些设置？

可以选择模型、画面比例、HD、2K 或 4K、1 张、2 张或 4 张输出，以及 PNG 或 JPEG。提示词最多 4,000 字符。先设比例，因为同一场景在方形和宽幅画面中会采用不同布局。输出尺寸由模型服务管理，用于尺寸要求严格的版式前，请检查下载文件大小。

### 图片接近预期但仍有问题，如何修改？

先指出一个问题：主体太小、背景太杂、光线太硬或表现方式不对。然后只修改对应指令，保留文生图提示词的其余部分。如果物体正确但相互关系不对，就重写哪个物体在前、哪个动作最重要。生成不是逐像素控制的实验，因此也要记录其他差异，不要将它们全部归因于这次修改。

### 文生图能准确呈现真实产品或人物吗？

不能稳定保证。文生图提示词创造的是想象场景，不能证明其中物体符合某件实物的形状、颜色、尺寸或材质，文字描述的角色也可能在不同图片间发生变化。真实物品或人物很重要时，应添加参考图，并将每个结果与原图对比。参考图或指定模型都不能锁定身份特征。

### 使用文生图需要账号吗？

登录前可以输入提示词，并选择模型、比例和分辨率。点击「生成」会打开登录弹窗，登录时文生图提示词与设置都会保留。

### 文生图请求失败怎么办？

任务会说明停止原因并提供重试；失败或取消的请求会释放预留积分。需要停止进行中的请求时，请使用取消控件，离开页面不会停止任务。图片完成后重写提示词会发起新的付费请求。

### 文生图需要多少积分？

每张图片使用 Nano Banana Pro 的 HD 或 2K 档位消耗 45 积分，使用 Nano Banana 的 HD 档位为 23 积分；4K 或更多图片会消耗更多积分。确认前，「生成」按钮会显示当前设置的准确总额。

## 把文字变成图片

描述主体、光线和版式需要的空间，下载前先比较结果。
