---
title: "Text to Image：テキストから画像を生成する AI | Potto AI"
description: "Potto AI の text to image で、文章のプロンプトを画像に。被写体、スタイル、構図を説明し、アスペクト比とサイズを選んで結果を比較できます。"
canonical: "https://potto.ai/ja/text-to-image"
language: "ja"
dateModified: "2026-10-07"
---

# Text to Image

被写体、構図、表現の方向性を説明し、生成された画像の候補を比較しましょう。

## 作例を試す

- **ノートの静物写真**: 窓辺の明るい木のテーブルに、閉じたノート、陶器のカップ、画面を下にしたスマートフォンを置いた、静かで写真らしい静物画を作成してください。柔らかなサイド光、落ち着いた暖色の配色を使い、左側にすっきりした余白を残した横長の構図にしてください。ノートの表紙は無地とし、文字は入れないでください。
- **優先順位を整理**: 机の上で、はっきり分かれた 3 つの紙のカードのグループを、明確な順序に並べているシンプルな記事用イラスト。すっきりした形、落ち着いた配色、ひとつの明確な移動方向を使ってください。背景は控えめにし、文字ラベルは入れないでください。
- **紙のランタン**: 静かな夕方の背景に、明るい紙のランタンをひとつ。ランタンは画面の上半分に配置し、下側は後から文字を入れられるよう、すっきりした余白にする。柔らかな光、落ち着いた配色。文字は入れない。

## プロンプトをひとつ変えて、text to image の結果を比較

ノート、カップ、スマートフォンを描く同じ text to image のプロンプトで 2 回生成し、光の方向だけを変えています。

![窓際の木のテーブルに置いた閉じたノート、陶器のカップ、スマートフォン。左からの光](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-left-1080.webp)

*左からの光*

![窓際の木のテーブルに置いた革表紙のノート、マグカップ、スマートフォン。右から光が差し、影は左側](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-right-1080.webp)

*右からの光*

### 残した要素

どちらのプロンプトも、閉じたノート、陶器のカップ、画面を伏せたスマートフォン、木のテーブルを指定し、横長の画面の左側に余白を設けています。この指示は同じでも、毎回それぞれの物を新たに描くため、2 枚の画像ではノート、カップ、テーブルが異なります。生成は画素単位で条件を固定した実験ではないため、細部も変わる場合があります。

### 変えた要素

変えたのは光だけです。最初の画像は左からの柔らかな窓の光、次の画像は右の低い位置からの温かい光です。影の方向が逆になり、テーブルに対するカップの見え方も変わります。比較するのは、この違いです。

### 確認する点

ノートに意図しない文字がないか、画面の内容が反射していないか、カップが増えていないかを確認します。そのうえで、素材を見分けやすくなったかなど、変更によって確かめたかったことに答えが出たかを考えましょう。ほかの違いも記録し、すべてを照明の指示の効果とは考えないでください。

## 3 つの掲載先に合わせた text to image のプロンプト

各 text to image プロンプトで、被写体、視点、レイアウトに必要な余白をそれぞれ指定します。

### 商品のストーリーを伝える静物写真

*16:9・記事のヘッダー*

メインの被写体をひとつと、それを支える物を 2～3 点選び、置く位置を指定します。淡い色のテーブルの右側に緑のティーポットとカップをひとつ置き、左から柔らかな光を当てれば、左側に見出し用の余白が残ります。小道具を増やさず、そうプロンプトに書きましょう。物同士が一体化していないかも確認してください。

![淡い色のテーブルの右側に緑のティーポットとカップ 1 つ。左からの柔らかな光と見出し用の左側の余白](https://cdn.potto.ai/images/text-to-image-teapot-headline-space-1080.webp)

### 抽象的なテーマを伝える記事用イラスト

*4:3・記事カード*

抽象的なテーマでは、長いプロンプトより先に、視覚的なアイデアをひとつ決めます。机の上で紙のカードを 3 つのグループに分け、順番に並べた図ならカードサイズでも伝わりますが、5 つの象徴的な意味を詰め込んでも伝わりません。すっきりした形、ひとつの移動方向、文字ラベルなしを指定し、グループが整然としているか、雑然としているかを確認しましょう。

![机の上で 3 つのグループの紙のカードを順に並べた、ラベルのないすっきりした記事用イラスト](https://cdn.potto.ai/images/text-to-image-paper-cards-editorial-1080.webp)

### トリミングしても伝わる SNS カード

*4:5・SNS 投稿*

被写体とアイデアをひとつずつ決め、掲載先に合うアスペクト比を選びます。縦長画面の上半分に明るい紙のランタンをひとつ置き、下側に後から文字を入れる余白を残すと、どこに見どころを置くかを生成ツールに伝えられます。実際に見られるサイズでトリミングを確認し、イベントの詳細はレイアウトツールで追加しましょう。

![縦長の 4:5 画面の上半分にある明るい紙のランタン。下側には文字用のすっきりした余白](https://cdn.potto.ai/images/text-to-image-paper-lantern-social-928.webp)

## text to image の使い方

上の作成カードで行う 3 ステップです。

### 1．シーンを書く

最大 4,000 文字の入力欄に、被写体とその場面を指定した text to image のプロンプトを書きます。視点、光、レイアウトに必要な余白を説明してください。生成画像内の文字は語句ごとの確認が必要なため、文言の正確さが重要な場合は、後から自分のレイアウトに追加する前提で考えましょう。

### 2．モデルと形を選ぶ

text to image の生成画面で [Nano Banana](https://potto.ai/ja/nano-banana.md) または [Nano Banana Pro](https://potto.ai/ja/nano-banana-pro.md) を選び、アスペクト比、HD・2K・4K、出力枚数の 1・2・4 枚、PNG または JPEG を指定します。同じシーンでも正方形と横長では配置が変わるため、アスペクト比を先に決めてください。言葉だけでは足りない場合に限り、参照画像を追加します。

### 3．生成して比較する

Nano Banana の HD 画像 1 枚は 23 クレジット、Nano Banana Pro の HD 画像 1 枚は 45 クレジットです。モデル、解像度、枚数を変えると「生成」に表示される消費クレジットの目安も変わります。構図全体と重要な細部を原寸で確認し、ダウンロードするか、条件をひとつ変えて再度試しましょう。

## text to image がプロンプトから読み取ること

文章のプロンプトで指定できる 4 つの要素と、結果での確認方法です。

### スタイル名だけでなく、シーンを説明する

text to image のプロンプトでは、被写体をひとつ決め、その位置と周囲にあるものを指定すると伝わりやすくなります。「淡い色のテーブルに緑のティーポットと空のカップをひとつ」と書けば、モデルは配置を考えられます。形容詞を並べるだけでは伝わりません。長文にしなくても、プロンプト欄に必要な細部を書き込めます。

- まず被写体とその場面を指定
- 長いリストではなく、被写体のそばに補助的な細部を配置

![テキストのプロンプトから生成した、淡い色のテーブルに置かれた緑のティーポットと空のカップ](https://cdn.potto.ai/images/text-to-image-teapot-single-subject-1080.webp)

*被写体をひとつに絞った静物画のプロンプト*

### 光とカメラの位置を決める

物を増やすよりも、光や視点を変えるほうが画像の印象は大きく変わります。左からの柔らかな窓の光、低いアングル、片側に余白のある横長の構図などを指定すると、text to image に明確な方向を伝えられます。ひとつずつ変えて結果を比較し、各指示の効果を確かめましょう。

- 光の方向と柔らかさを指定
- 余白を残す場所を説明

![同じ text to image のプロンプトで、光を反対側から当てた 2 つの生成結果](https://cdn.potto.ai/images/text-to-image-light-opposite-sides-1080.webp)

*同じプロンプトで光を反対側に移した比較*

### アスペクト比と解像度を先に選ぶ

生成前にアスペクト比と解像度を選びます。縦長、正方形、横長では、同じシーンでも異なる配置が必要になるため、使用場所に合わせてアスペクト比を設定してください。変更のたびに「生成」の消費クレジットの目安が更新されます。

- HD から 4K までの解像度
- 画像枚数は 1、2、4 枚から選択

![text to image の同じシーンを、横長、正方形、縦長のアスペクト比に合わせて配置した画像](https://cdn.potto.ai/images/text-to-image-teapot-three-ratios-1080.webp)

*同じシーンを横長、正方形、縦長の画面に合わせて構成*

### 言葉だけでは足りないときに参照画像を追加

text to image は言葉から始まります。実在する物や特定の見た目に合わせたい場合は、最大 14 枚の参照画像を追加できます。それぞれの用途をプロンプトで説明してください。参照画像を添付しない場合、結果はプロンプトだけを基に作られます。

- リクエストごとに最大 14 枚の参照画像
- 各参照画像の役割を指定

![プロンプト欄の隣に参照画像の枠がある作成カード](https://cdn.potto.ai/images/text-to-image-creation-card-reference-slot-1080.webp)

*プロンプトの隣に追加した参照画像*

## Potto AI をさらに見る

画像に次に必要な作業に合うページを選びましょう。

- [Image to Image](https://potto.ai/ja/image-to-image.md): 手元の参照画像から始められます。
- [AI 写真生成](https://potto.ai/ja/ai-photo-generator.md): 写真らしい光、構図、素材の細部を説明します。
- [AI イラスト生成](https://potto.ai/ja/ai-art-generator.md): 画材、配色、構図を選びます。
- [AI キャラクター生成](https://potto.ai/ja/ai-character-generator.md): 目に見える特徴を選んでキャラクターを説明します。
- [画像編集 AI](https://potto.ai/ja/ai-image-editor.md): 完成した画像のひとつの要素を変更します。
- [AI 画像生成](https://potto.ai/ja/ai-image-generator.md): モデル、アスペクト比、解像度、参照画像をまとめて設定できます。

## Text to Image のよくある質問

### text to image とは何ですか？

text to image は、文章による説明だけから画像を生成することです。参照画像をアップロードせずに、プロンプトで被写体、構図、光、表現方法を指定できます。Potto AI は text to image に対応した [AI 画像生成](https://potto.ai/ja/ai-image-generator.md)ツールとして、選んだモデルと設定で画像を作り、確認・ダウンロードできるようにします。プロンプトは制作の方向性を示すもので、すべての指示が正確に反映される保証ではありません。

### 画像生成に役立つプロンプトには何を書けばよいですか？

text to image のプロンプトには、目に見える被写体、周囲との関係、構図、用途に必要な表現方法を書きます。被写体の横にすっきりした余白を残すなど、必要な条件も指定しましょう。矛盾する指示や、目に見えない細部は避けてください。次の修正では、確認できる問題をひとつ取り上げます。

### 画像内に正確な文字を生成できますか？

文字を指定することはできますが、完成した画像ですべての語句と読みやすさを確認してください。正確な名前、日付、ラベル、長い文案が必要な場合は、確認済みの画像の上に、レイアウトで編集可能な文字を重ねましょう。生成画像は編集可能な文書ではなく、高解像度であることも文字の正確さの証拠にはなりません。

### 生成前にどのような設定を選べますか？

モデル、アスペクト比、HD・2K・4K、出力枚数の 1・2・4 枚、PNG または JPEG を選べます。プロンプトは最大 4,000 文字です。同じシーンでも正方形と横長では配置が変わるため、最初にアスペクト比を決めてください。出力寸法は提供元が決めるので、サイズ条件の厳しいレイアウトで使う前に、ダウンロードしたファイルの寸法を確認しましょう。

### 惜しいけれど意図と違う画像はどう直せばよいですか？

まず、被写体が小さすぎる、背景がうるさい、光が強すぎる、表現が違うといった問題をひとつ明確にします。その指示だけを変え、text to image のプロンプトの残りは保ちましょう。物は合っていても関係が違う場合は、どちらが手前にあるか、どの動作が重要かを書き直します。生成はピクセル単位で条件を固定した実験ではないため、ほかの違いも記録し、すべてを編集の効果とは考えないでください。

### text to image で実在の商品や人物を再現できますか？

確実には再現できません。text to image のプロンプトは想像上のシーンを作るもので、特定の品物の形、色、寸法、素材と一致することを保証しません。文章で説明したキャラクターも、画像ごとに変わることがあります。実物や本人との一致が大切な場合は、参照画像を追加し、各結果を元画像と比較してください。参照画像や特定のモデル名を使っても、同一性を固定することはできません。

### text to image にアカウントは必要ですか？

ログイン前に、プロンプトを入力し、モデル、アスペクト比、解像度を選べます。「生成」を押すとログイン画面が開き、ログイン中も text to image のプロンプトと設定は保持されます。

### text to image のリクエストに失敗した場合はどうなりますか？

タスクに停止理由と再試行の操作が表示されます。失敗またはキャンセルされたリクエストでは、予約済みクレジットが解放されます。ページを離れるだけでは止まらないため、実行中のリクエストを停止するにはキャンセル操作を使ってください。画像の完成後にプロンプトを書き直して生成すると、新たに料金がかかるリクエストになります。

### text to image は何クレジット使いますか？

画像 1 枚あたり、Nano Banana Pro の HD または 2K は 45 クレジット、Nano Banana の HD は 23 クレジットです。4K や複数枚の生成では消費量が増えます。確定前に「生成」ボタンで、設定に応じた消費クレジットの目安として正確な合計を確認できます。

## 文章を画像に変える

被写体、光、レイアウトに必要な余白を説明し、結果を比較してからダウンロードしましょう。
