---
title: "文字生成圖片 AI 工具 | Potto AI"
description: "透過 Potto AI 文字生成圖片，將提示詞化為圖片。描述主體、風格與構圖，選擇比例和尺寸，再比較結果。"
canonical: "https://potto.ai/zh-Hant/text-to-image"
language: "zh-Hant"
dateModified: "2026-10-07"
---

# 文字生成圖片

描述主體、構圖與視覺方向，再比較生成的候選圖片。

## 試試範例

- **筆記本靜物**: 製作安靜的攝影靜物畫面：闔上的筆記本、一只陶瓷杯，以及螢幕朝下的手機，放在窗邊淺色木桌上。使用柔和側光、內斂暖色配色與寬幅構圖，左側保持乾淨留白。筆記本封面維持素面，不要有文字。
- **排序優先事項**: 簡單的編輯插畫：桌上 3 組明確分開的紙卡，正在排成清楚的順序。使用簡潔形狀、內斂配色與單一明確的移動方向。背景保持簡單，避免文字標籤。
- **紙燈籠**: 一盞明亮紙燈籠，背景是寧靜的傍晚。燈籠位於畫面上半部，下方留出乾淨區域供之後加字。柔和光暈、內斂配色，不要有文字。

## 一份提示詞、一項改變：比較兩次文字生成圖片結果

以同一份文字生成圖片提示詞，生成筆記本、杯子與手機 2 次，僅改變光線方向。

![闔上的筆記本、陶瓷杯與手機放在窗邊木桌上，光線來自左側](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-left-1080.webp)

*左側光線*

![皮革筆記本、馬克杯與手機放在窗邊木桌上，右側光線使陰影落向左側](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-right-1080.webp)

*右側光線*

### 保留的元素

兩份提示詞都指定相同的闔上筆記本、陶瓷杯、螢幕朝下的手機與木桌，採寬幅構圖，左側留白。這些指令沒有改變，但每次生成都會重新描繪物件，因此兩張圖片中的筆記本、杯子與桌面仍有差異。細節可能變動，因為生成並非逐像素控制的實驗。

### 改變的元素

只改變光線：第一張圖片使用左側柔和窗光，第二張改為右側低角度暖光。陰影方向隨之反轉，杯子與桌面的視覺關係也不同。這一項差異，就是本次比較的重點。

### 需要檢查的地方

留意筆記本上是否出現多餘文字、螢幕內容反射，以及額外的杯子。再判斷這項改變是否回答了你的問題，例如材質是否更容易辨識。記錄其他差異，不要全部歸因於光線指令。

## 適用 3 種版位的文字生成圖片提示詞

每份文字生成圖片提示詞都指出一個主體、一個視角，以及版面所需的空間。

### 產品故事的靜物畫面

*16:9 · 文章頁首*

選擇一個主體與 2 或 3 件輔助物件，再說明它們的位置。綠色茶壺與一只杯子放在淺色桌面右側，左方柔光照入，就能在左側保留標題空間。將這些寫進提示詞，不必再增加道具。請檢查物件是否彼此融合。

![綠色茶壺與一只杯子位於淺色桌面右側，左側柔光照入，左方留出標題空間](https://cdn.potto.ai/images/text-to-image-teapot-headline-space-1080.webp)

### 抽象主題的編輯插畫

*4:3 · 文章卡片*

抽象主題首先需要一個視覺想法，再考慮長提示詞。桌面上 3 組紙卡排成順序，在卡片尺寸下仍能看懂；5 種象徵意義卻未必。要求簡潔形狀、單一移動方向與無文字標籤，再檢查各組紙卡看起來是有序還是雜亂。

![桌上 3 組紙卡排成明確順序，以簡潔的編輯插畫呈現，沒有標籤](https://cdn.potto.ai/images/text-to-image-paper-cards-editorial-1080.webp)

### 裁切後仍清楚的社群圖片

*4:5 · 社群貼文*

先確定一個主體與一個想法，再依展示位置選擇比例。一盞明亮紙燈籠位於直式畫面上半部，下方留出乾淨區域供後續加字，就能告訴生成工具焦點應放在哪裡。以觀眾實際看到的尺寸測試裁切，再於排版工具中加入活動資訊。

![一盞明亮紙燈籠位於直式 4:5 畫面上半部，下方保留乾淨留白供文字使用](https://cdn.potto.ai/images/text-to-image-paper-lantern-social-928.webp)

## 如何使用文字生成圖片

在上方創作卡片中完成 3 個步驟。

### 1. 描述場景

在最多接受 4,000 個字元的提示詞欄位中，為一個主體與其場景撰寫文字生成圖片提示詞。交代視角、光線與版面所需的空間。若文字內容必須精確，請規劃稍後自行排版加入，因為生成像素中的文字需要逐字檢查。

### 2. 選擇模型與畫面形狀

在文字生成圖片工具中選擇 [Nano Banana](https://potto.ai/zh-Hant/nano-banana.md) 或 [Nano Banana Pro](https://potto.ai/zh-Hant/nano-banana-pro.md)，再選畫面比例、HD、2K 或 4K、1、2 或 4 張輸出，以及 PNG 或 JPEG。請先設定比例，因為相同場景在正方形與寬幅畫面中的配置不同。只有文字不足以描述時，才加入參考圖。

### 3. 生成並比較

1 張 Nano Banana HD 圖片需 23 點數，1 張 Nano Banana Pro HD 圖片需 45 點數；更換模型、解析度或張數，會改變「生成」按鈕上的預估消耗點數。以原尺寸檢視整體構圖與一項關鍵細節，再下載，或修改一個選項後重試。

## 文字生成圖片工具如何運用提示詞

文字提示詞可控制的 4 個面向，以及如何逐項檢查結果。

### 描述場景，而非只寫風格標籤

文字生成圖片提示詞最好能指出一個主體、它的位置與周圍環境。「淺色桌面上的綠色茶壺與一只空杯」能讓模型知道如何配置，單列形容詞則不行。提示詞欄位有足夠空間交代細節，不需要堆成一大段文字。

- 先交代一個主體與其場景
- 補充主體旁的細節，不列冗長清單

![依文字提示詞生成的綠色茶壺與一只空杯，放在淺色桌面上](https://cdn.potto.ai/images/text-to-image-teapot-single-subject-1080.webp)

*聚焦單一主體的靜物提示詞*

### 設定光線與相機位置

光線與視角對圖片的影響，比增加物件更明顯。左側柔和窗光、低角度視角，或一側留白的寬幅構圖，都能為文字生成圖片工具提供清楚方向。每次只改變其中一項，再比較結果，看看各句指令的作用。

- 說明光線方向與柔和程度
- 指出留白應該在哪裡

![同一份文字生成圖片提示詞的 2 個結果，光線分別來自相反側](https://cdn.potto.ai/images/text-to-image-light-opposite-sides-1080.webp)

*同一份提示詞，將光線移到另一側*

### 先選擇畫面比例與解析度

生成前先選擇畫面比例與解析度。同一場景在直式、正方形與寬幅畫面中，需要不同配置，因此應依圖片用途設定比例。每次變更都會更新「生成」按鈕上的預估消耗點數。

- HD 至 4K 解析度
- 可選 1、2 或 4 張圖片

![同一個文字生成圖片場景，分別配置為寬幅、正方形與直式畫面比例](https://cdn.potto.ai/images/text-to-image-teapot-three-ratios-1080.webp)

*同一場景的寬幅、正方形與直式配置*

### 只有文字不足以描述時，才加入參考圖

文字生成圖片從文字開始；需要符合真實物件或特定外觀時，可加入最多 14 張參考圖。請在提示詞中說明各張參考圖的用途。沒有附加參考圖時，結果僅依提示詞生成。

- 每次請求最多 14 張參考圖
- 說明各張參考圖的用途

![創作卡片中的提示詞欄位旁設有參考圖欄位](https://cdn.potto.ai/images/text-to-image-creation-card-reference-slot-1080.webp)

*在提示詞旁加入的參考圖*

## 探索更多 Potto AI

依圖片接下來需要的處理，選擇合適的頁面。

- [圖生圖](https://potto.ai/zh-Hant/image-to-image.md): 從你現有的參考圖開始。
- [AI 照片生成](https://potto.ai/zh-Hant/ai-photo-generator.md): 描述攝影般的光線、取景與材質細節。
- [AI 繪畫](https://potto.ai/zh-Hant/ai-art-generator.md): 選擇媒材、配色與構圖。
- [AI 角色生成器](https://potto.ai/zh-Hant/ai-character-generator.md): 透過可見的細節描述角色。
- [AI 修圖](https://potto.ai/zh-Hant/ai-image-editor.md): 修改完成圖片中的一個部分。
- [AI 畫圖](https://potto.ai/zh-Hant/ai-image-generator.md): 完整設定模型、畫面比例、解析度與參考圖。

## 文字生成圖片常見問題

### 什麼是文字生成圖片？

文字生成圖片是僅根據文字描述產生圖片的方式。提示詞可以指定主體、構圖、光線與視覺處理，不必上傳參考圖。Potto AI 提供文字生成圖片功能，使用你選擇的模型與設定製作圖片，供你檢視與下載。提示詞是創作方向，不保證每項指令都會精確呈現。

### 實用的圖片提示詞應包含什麼？

文字生成圖片的提示詞應包含可見的主體、主體與場景的關係、構圖，以及符合最終用途的視覺處理。說明相關限制，例如主體旁需保留乾淨區域。避免互相矛盾的指示，以及畫面中看不見的細節。下一次修改應針對一個可以觀察到的問題。

### 可以在圖片內生成完全正確的文字嗎？

你可以要求生成文字，但必須在完成的結果中逐字核對內容與可讀性。若姓名、日期、標籤或較長文案必須精確，請先檢視圖片，再於版面上加上可編輯文字。生成圖片不是可編輯的文字文件，更高解析度也不代表其中的文字正確。

### 生成前可以選擇哪些設定？

可選擇模型、畫面比例、HD、2K 或 4K、1、2 或 4 張輸出，以及 PNG 或 JPEG。提示詞欄位最多接受 4,000 個字元。請先設定比例，因為相同場景在正方形與寬幅畫面中的配置不同。輸出尺寸由模型服務決定，用於尺寸要求較高的版面前，請先檢查下載檔案的大小。

### 圖片接近需求卻仍有問題，該怎麼修正？

先指出一個問題：主體太小、背景太雜、光線太刺眼，或視覺處理不對。只修改這項指令，保留文字生成圖片提示詞的其他部分。若物件正確但相互關係不對，就重寫哪個物件在前方，以及哪個動作最重要。生成並非逐像素控制的實驗，請記錄其他差異，不要將所有變化都歸因於這次修改。

### 文字生成圖片能準確呈現真實產品或人物嗎？

無法穩定保證。文字生成圖片提示詞會產生想像中的場景，不能證明物件符合某件實物的外形、色彩、尺寸或材質；文字描述的角色也可能在不同圖片間出現差異。若真實物品或人物的特徵很重要，請加入參考圖，並將每個結果與來源比對。參考圖或指定模型都不能鎖定身分特徵。

### 使用文字生成圖片需要帳號嗎？

登入前，你可以先輸入提示詞，選擇模型、畫面比例與解析度。按下「生成」會開啟登入視窗；登入期間，文字生成圖片的提示詞與設定都會保留。

### 文字生成圖片請求失敗時會怎樣？

任務會說明停止原因並提供重試選項；失敗或取消的請求會釋放預留點數。若要停止正在執行的請求，請使用取消控制項，離開頁面不會停止任務。圖片完成後修改提示詞並重新生成，會開始新的付費請求。

### 文字生成圖片需要多少點數？

使用 Nano Banana Pro 生成 HD 或 2K 圖片，每張需 45 點數；使用 Nano Banana 生成 HD 圖片，每張需 23 點數。4K 或更多張圖片的費用較高。確認前，「生成」按鈕會顯示目前設定的確切總額。

## 將文字化為圖片

描述主體、光線與版面所需的留白，比較結果後再下載。
