---
title: "Text to Image AI: tạo ảnh từ văn bản | Potto AI"
description: "Biến một prompt văn bản thành ảnh với text to image trên Potto AI. Mô tả chủ thể, phong cách và bố cục, chọn tỷ lệ và kích thước, rồi so sánh kết quả."
canonical: "https://potto.ai/vi/text-to-image"
language: "vi"
dateModified: "2026-10-07"
---

# Text to Image

Mô tả chủ thể, bố cục và định hướng ảnh trước khi so sánh các phương án ảnh được tạo.

## Thử một ví dụ

- **Tĩnh vật sổ tay**: Tạo một tĩnh vật nhiếp ảnh yên tĩnh gồm một cuốn sổ đóng, một chiếc cốc gốm và một chiếc điện thoại úp mặt trên bàn gỗ sáng màu bên cửa sổ. Dùng ánh sáng bên dịu, một bảng màu ấm tiết chế, và bố cục rộng với khoảng trống gọn gàng bên trái. Giữ bìa sổ trơn, không có chữ.
- **Sắp xếp thứ tự ưu tiên**: Một minh họa biên tập đơn giản về ba nhóm thẻ giấy riêng biệt đang được sắp thành một trình tự rõ ràng trên bàn. Dùng hình khối sạch, một bảng màu tiết chế, và một hướng chuyển động rõ ràng. Giữ nền yên tĩnh và tránh nhãn viết chữ.
- **Đèn lồng giấy**: Một chiếc đèn lồng giấy sáng trên nền buổi tối yên tĩnh, với đèn lồng ở nửa trên của khung và vùng dưới sạch để trống cho chữ thêm sau. Ánh sáng dịu, bảng màu tiết chế, không có chữ.

## Một prompt, một thay đổi: so sánh hai kết quả ảnh từ text to image

Một prompt text to image tạo ảnh cho một cuốn sổ, một chiếc cốc và một chiếc điện thoại, chạy hai lần. Chỉ hướng sáng thay đổi.

![Sổ đóng, cốc gốm và một chiếc điện thoại trên bàn gỗ bên cửa sổ, được chiếu sáng từ bên trái](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-left-1080.webp)

*Ánh sáng từ bên trái*

![Một cuốn sổ da, cốc và điện thoại trên bàn gỗ bên cửa sổ, được chiếu sáng từ bên phải với bóng đổ về bên trái](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-right-1080.webp)

*Ánh sáng từ bên phải*

### Giữ nguyên

Cả hai prompt đều nêu cùng một cuốn sổ đóng, cốc gốm, điện thoại úp mặt và bàn gỗ, trong khung rộng với khoảng trống bên trái. Những chỉ dẫn đó không thay đổi, nhưng mỗi lần chạy lại vẽ các đối tượng mới, nên cuốn sổ, chiếc cốc và chiếc bàn khác nhau giữa hai ảnh. Các chi tiết nhỏ vẫn có thể lệch, vì tạo ảnh không phải thí nghiệm từng điểm ảnh.

### Đã thay đổi

Chỉ có ánh sáng: ánh sáng cửa sổ dịu từ bên trái ở ảnh đầu, ánh sáng ấm thấp từ bên phải ở ảnh thứ hai. Bóng đổ ngược lại và chiếc cốc trông khác đi trên nền bàn. Chính khác biệt duy nhất đó là điều bạn đang so sánh.

### Cần kiểm tra

Hãy tìm chữ vô tình xuất hiện trên cuốn sổ, nội dung màn hình phản chiếu và những chiếc cốc thừa. Sau đó tự hỏi liệu thay đổi có trả lời câu hỏi của bạn không, chẳng hạn chất liệu có dễ nhận ra hơn không. Hãy ghi nhận các khác biệt khác thay vì quy hết cho dòng mô tả ánh sáng.

## Prompt text to image cho ba vị trí hiển thị ảnh

Mỗi prompt text to image nêu một chủ thể, một góc nhìn và khoảng trống mà bố cục ảnh cần.

### Tĩnh vật cho một bài viết sản phẩm

*16:9 · Tiêu đề bài viết*

Chọn một chủ thể và hai hoặc ba đối tượng phụ, rồi nói rõ vị trí của chúng. Một ấm trà xanh và một chiếc cốc trên bàn nhạt màu, đặt bên phải với ánh sáng dịu từ bên trái, để trống phía bên trái cho một tiêu đề. Hãy nói điều đó trong prompt thay vì thêm nhiều đạo cụ. Kiểm tra rằng các đối tượng không hòa vào nhau.

![Ấm trà xanh và một chiếc cốc trên bàn nhạt màu ở bên phải, được chiếu sáng dịu từ bên trái, với khoảng trống bên trái cho một tiêu đề](https://cdn.potto.ai/images/text-to-image-teapot-headline-space-1080.webp)

### Minh họa biên tập cho một chủ đề trừu tượng

*4:3 · Thẻ bài viết*

Một chủ đề trừu tượng cần một ý tưởng ảnh trước khi cần một prompt dài. Ba nhóm thẻ giấy được sắp thành một trình tự trên bàn đọc rõ ở kích thước thẻ; năm ý nghĩa biểu tượng thì không. Hãy yêu cầu hình khối sạch, một hướng chuyển động và không có nhãn viết chữ, rồi kiểm tra xem các nhóm trông có trật tự hay lộn xộn.

![Ba nhóm thẻ giấy được sắp thành một trình tự trên bàn, được vẽ như một minh họa biên tập sạch sẽ không có nhãn](https://cdn.potto.ai/images/text-to-image-paper-cards-editorial-1080.webp)

### Thẻ mạng xã hội vẫn ổn sau khi cắt ảnh

*4:5 · Bài đăng mạng xã hội*

Xác định một chủ thể và một ý tưởng, rồi chọn tỷ lệ theo nơi ảnh sẽ được nhìn thấy. Một chiếc đèn lồng giấy sáng ở nửa trên của khung cao, với vùng dưới sạch để thêm chữ sau, cho trình tạo biết điểm nhấn nằm ở đâu. Hãy thử cắt ảnh ở kích thước mọi người sẽ thấy, và thêm chi tiết sự kiện trong công cụ bố cục của bạn.

![Một chiếc đèn lồng giấy sáng ở nửa trên của khung 4:5 cao, với vùng dưới sạch để chừa cho chữ](https://cdn.potto.ai/images/text-to-image-paper-lantern-social-928.webp)

## Cách dùng text to image để tạo ảnh

Ba bước trong thẻ tạo ở trên.

### 1. Viết cảnh

Viết một prompt text to image cho một chủ thể và bối cảnh của nó vào ô prompt, nơi nhận tối đa 4.000 ký tự. Nêu góc nhìn, ánh sáng và khoảng trống mà bố cục của bạn cần. Nếu câu chữ chính xác quan trọng, hãy dự định thêm nó sau trong bố cục của riêng bạn, vì chữ viết bên trong các điểm ảnh được tạo cần kiểm tra từng từ.

### 2. Chọn mô hình và hình dạng

Chọn [Nano Banana](https://potto.ai/vi/nano-banana.md) hoặc [Nano Banana Pro](https://potto.ai/vi/nano-banana-pro.md) trong trình tạo text to image, rồi một tỷ lệ khung hình, HD, 2K hoặc 4K, một, hai hoặc bốn kết quả, và PNG hoặc JPEG. Đặt tỷ lệ trước, vì cùng một cảnh được sắp xếp khác nhau trong khung vuông và khung rộng. Chỉ thêm ảnh tham chiếu khi ngôn từ không đủ.

### 3. Tạo và so sánh

Một ảnh Nano Banana HD tốn 23 credit và một ảnh Nano Banana Pro HD tốn 45; thay đổi mô hình, độ phân giải hoặc số lượng sẽ thay đổi mức credit dự kiến hiển thị trên nút Tạo ảnh. Hãy xem lại toàn bộ bố cục và một chi tiết quan trọng ở kích thước đầy đủ, rồi tải xuống, hoặc đổi một lựa chọn và thử lại.

## Trình tạo text to image làm gì với prompt ảnh của bạn

Bốn điều mà một prompt văn bản kiểm soát, và cách kiểm tra từng điều trong kết quả.

### Mô tả cảnh, không phải một nhãn phong cách

Một prompt tạo ảnh bằng text to image hoạt động tốt nhất khi nó nêu một chủ thể, vị trí của nó và những gì bao quanh. “Một ấm trà xanh và một chiếc cốc rỗng trên bàn nhạt màu” cho mô hình thứ để sắp xếp; một danh sách tính từ thì không. Ô prompt đủ chỗ cho chi tiết mà không cần một bức tường chữ.

- Chủ thể và bối cảnh của nó trước tiên
- Chi tiết phụ bên cạnh chủ thể, không phải một danh sách dài

![Ấm trà xanh và một chiếc cốc rỗng trên bàn nhạt màu, được tạo từ một prompt văn bản](https://cdn.potto.ai/images/text-to-image-teapot-single-subject-1080.webp)

*Một prompt tĩnh vật với một chủ thể*

### Thiết lập ánh sáng và vị trí máy ảnh

Ánh sáng và góc nhìn thay đổi một bức ảnh nhiều hơn các đối tượng thêm vào. Ánh sáng cửa sổ dịu từ bên trái, một góc thấp, hay một khung rộng với khoảng trống ở một bên đều cho trình tạo text to image một định hướng rõ ràng. Hãy thay đổi từng điều một và so sánh kết quả để thấy mỗi dòng đã làm gì.

- Nêu hướng và độ dịu của ánh sáng
- Nói rõ khoảng trống nên nằm ở đâu

![Hai kết quả ảnh của cùng một prompt text to image được chiếu sáng từ hai phía đối diện](https://cdn.potto.ai/images/text-to-image-light-opposite-sides-1080.webp)

*Cùng một prompt với ánh sáng chuyển sang phía bên kia*

### Chọn tỷ lệ và độ phân giải trước

Chọn một tỷ lệ khung hình và một độ phân giải trước khi tạo. Khung cao, khung vuông và khung rộng mỗi loại đòi hỏi một cách sắp xếp khác nhau cho cùng một cảnh, nên hãy đặt tỷ lệ theo nơi ảnh sẽ được dùng. Mức credit dự kiến trên nút Tạo ảnh cập nhật theo mỗi thay đổi.

- Độ phân giải từ HD đến 4K
- Lựa chọn một, hai hoặc bốn ảnh

![Một cảnh text to image được sắp xếp cho tỷ lệ khung hình rộng, vuông và cao](https://cdn.potto.ai/images/text-to-image-teapot-three-ratios-1080.webp)

*Một cảnh được thiết lập cho khung rộng, khung vuông và khung cao*

### Chỉ thêm ảnh tham chiếu khi ngôn từ không đủ

Text to image bắt đầu từ ngôn từ, và bạn có thể thêm tối đa 14 ảnh tham chiếu khi cần khớp với một vật thể thật hoặc một phong cách. Hãy nói trong prompt mỗi ảnh tham chiếu dùng để làm gì. Khi không đính kèm ảnh tham chiếu, kết quả được xây dựng chỉ từ prompt.

- Tối đa 14 ảnh tham chiếu mỗi yêu cầu
- Nêu nhiệm vụ của từng ảnh tham chiếu

![Thẻ tạo với một ô ảnh tham chiếu bên cạnh ô prompt](https://cdn.potto.ai/images/text-to-image-creation-card-reference-slot-1080.webp)

*Một ảnh tham chiếu được thêm bên cạnh prompt*

## Khám phá thêm Potto AI

Chọn trang phù hợp với điều bức ảnh cần làm tiếp theo.

- [Image to Image AI](https://potto.ai/vi/image-to-image.md): Bắt đầu từ một ảnh tham chiếu bạn đã có.
- [AI Photo Generator](https://potto.ai/vi/ai-photo-generator.md): Mô tả ánh sáng kiểu máy ảnh, khung hình và chi tiết chất liệu.
- [AI Art Generator](https://potto.ai/vi/ai-art-generator.md): Chọn một chất liệu, một bảng màu và một bố cục.
- [Tạo nhân vật bằng AI](https://potto.ai/vi/ai-character-generator.md): Mô tả một nhân vật qua những lựa chọn nhìn thấy được.
- [Chỉnh sửa ảnh bằng AI](https://potto.ai/vi/ai-image-editor.md): Thay đổi một thứ trong một ảnh đã hoàn thiện.
- [AI tạo ảnh](https://potto.ai/vi/ai-image-generator.md): Thiết lập đầy đủ mô hình, tỷ lệ, độ phân giải và ảnh tham chiếu.

## Câu hỏi thường gặp về Text to Image và cách tạo ảnh

### text to image là gì?

Text to image là việc tạo ra một ảnh chỉ từ mô tả bằng văn bản. Prompt có thể thiết lập chủ thể, bố cục, ánh sáng và cách xử lý mà không cần ảnh tham chiếu nào tải lên. Potto AI hoạt động như một trình tạo ảnh text to image: nó dùng mô hình và thiết lập bạn chọn để tạo ảnh mà bạn xem xét và tải xuống. Prompt là một định hướng sáng tạo, không phải bảo đảm rằng mọi chỉ dẫn đều xuất hiện chính xác.

### Một prompt ảnh hữu ích nên chứa những gì?

Một prompt text to image nên gồm chủ thể nhìn thấy được, mối quan hệ của nó với bối cảnh, bố cục, và cách xử lý cần cho nơi sẽ đăng. Hãy nêu một ràng buộc liên quan, chẳng hạn một vùng thoáng bên cạnh chủ thể. Tránh các chỉ dẫn mâu thuẫn và chi tiết không thể nhìn thấy. Hãy để lần chỉnh sửa tiếp theo giải quyết một vấn đề quan sát được.

### Tôi có thể tạo đúng chữ cụ thể bên trong ảnh không?

Bạn có thể yêu cầu chữ viết, nhưng hãy kiểm tra từng từ và độ dễ đọc của nó trong kết quả hoàn chỉnh. Với tên, ngày, nhãn hoặc đoạn chữ dài chính xác, hãy đặt văn bản có thể chỉnh sửa lên một ảnh đã được duyệt trong bố cục của bạn. Ảnh được tạo không phải tài liệu văn bản có thể chỉnh sửa, và độ phân giải cao hơn không chứng minh chữ trong đó đúng.

### Tôi có thể chọn những thiết lập nào trước khi tạo?

Chọn một mô hình, một tỷ lệ khung hình, HD, 2K hoặc 4K, một, hai hoặc bốn kết quả, và PNG hoặc JPEG. Ô prompt nhận tối đa 4.000 ký tự. Hãy đặt tỷ lệ trước, vì cùng một cảnh được sắp xếp khác nhau trong khung vuông và khung rộng. Kích thước đầu ra do nhà cung cấp quản lý, nên hãy kiểm tra kích thước tệp đã tải xuống trước khi dùng trong bố cục khắt khe.

### Làm sao sửa một ảnh gần đúng nhưng còn sai?

Trước tiên hãy gọi tên một vấn đề: chủ thể quá nhỏ, nền quá rối, ánh sáng quá gắt hoặc cách xử lý sai. Sau đó chỉ thay đổi chỉ dẫn đó và giữ nguyên phần còn lại của prompt text to image. Nếu các đối tượng đúng có mối quan hệ sai, hãy viết lại đối tượng nào ở phía trước và hành động nào quan trọng. Tạo ảnh không phải thí nghiệm từng điểm ảnh, nên hãy ghi nhận các khác biệt khác thay vì quy hết cho chỉnh sửa của bạn.

### Ảnh tạo bằng text to image có thể khớp với một sản phẩm hay người thật không?

Không đáng tin cậy. Một prompt text to image tạo ra một cảnh tưởng tượng; nó không xác lập rằng một đối tượng khớp với hình dáng, màu sắc, kích thước hay chất liệu của một món đồ cụ thể, và một nhân vật được mô tả có thể không giữ được nhất quán từ ảnh này sang ảnh khác. Khi món đồ hay người thật quan trọng, hãy thêm ảnh tham chiếu và so sánh từng kết quả với ảnh nguồn. Ảnh tham chiếu hay một mô hình có tên không tạo ra khóa nhận dạng.

### Tôi có cần tài khoản để tạo ảnh với text to image không?

Bạn có thể nhập prompt và chọn mô hình, tỷ lệ cùng độ phân giải trước khi đăng nhập. Tạo ảnh sẽ mở hộp thoại đăng nhập, và prompt text to image cùng thiết lập của bạn được giữ trong khi bạn đăng nhập.

### Nếu một yêu cầu tạo ảnh bằng text to image thất bại thì sao?

Tác vụ giải thích lý do dừng và cho phép thử lại; credit đã giữ sẽ được hoàn cho yêu cầu thất bại hoặc bị hủy. Hãy dùng nút hủy để dừng một yêu cầu đang chạy, vì rời khỏi trang không dừng nó. Viết lại prompt sau khi một ảnh đã hoàn tất sẽ bắt đầu một yêu cầu mới và bị tính credit.

### Tạo ảnh bằng text to image tốn bao nhiêu credit?

Mỗi ảnh tốn 45 credit với Nano Banana Pro ở HD hoặc 2K, hoặc 23 với Nano Banana ở HD; 4K và nhiều ảnh hơn tốn thêm. Nút Tạo ảnh hiển thị tổng chính xác cho thiết lập của bạn trước khi bạn xác nhận.

## Biến văn bản của bạn thành ảnh

Mô tả chủ thể, ánh sáng và khoảng trống mà bố cục của bạn cần, rồi so sánh kết quả trước khi tải xuống.
