---
title: "Generador de texto a imagen con IA | Potto AI"
description: "Convierte un prompt en imágenes con texto a imagen de Potto AI. Describe sujeto, estilo y composición, elige relación de aspecto y tamaño, y compara resultados."
canonical: "https://potto.ai/es/text-to-image"
language: "es"
dateModified: "2026-10-07"
---

# Texto a imagen

Describe el sujeto, la composición y la dirección visual antes de comparar las imágenes generadas.

## Prueba un ejemplo

- **Naturaleza muerta con libreta**: Crea una naturaleza muerta fotográfica tranquila con una libreta cerrada, una taza de cerámica y un teléfono boca abajo sobre una mesa de madera clara junto a una ventana. Usa luz lateral suave, una paleta cálida discreta y una composición horizontal con espacio despejado a la izquierda. Mantén lisa la cubierta de la libreta, sin texto.
- **Ordenar prioridades**: Ilustración editorial sencilla de tres grupos distintos de tarjetas de papel que se ordenan en una secuencia clara sobre un escritorio. Usa formas limpias, una paleta discreta y una dirección de movimiento evidente. Mantén un fondo tranquilo y evita las etiquetas escritas.
- **Farol de papel**: Un farol de papel brillante sobre un fondo nocturno tranquilo, con el farol en la mitad superior del encuadre y una zona inferior limpia y vacía para añadir texto después. Resplandor suave, paleta discreta, sin letras.

## Un prompt, un cambio: compara dos resultados de texto a imagen

Un prompt de texto a imagen para una libreta, una taza y un teléfono, usado para generar dos imágenes. Solo cambió la dirección de la luz.

![Libreta cerrada, taza de cerámica y teléfono sobre una mesa de madera junto a una ventana, iluminados desde la izquierda](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-left-1080.webp)

*Luz desde la izquierda*

![Libreta de cuero, taza y teléfono sobre una mesa de madera junto a una ventana, iluminados desde la derecha con sombras hacia la izquierda](https://cdn.potto.ai/images/text-to-image-notebook-lit-from-right-1080.webp)

*Luz desde la derecha*

### Qué se mantiene

Ambos prompts describen la misma libreta cerrada, taza de cerámica, teléfono boca abajo y mesa de madera, en un encuadre horizontal con espacio vacío a la izquierda. Esas instrucciones no cambiaron, pero cada generación vuelve a dibujar los objetos, por lo que la libreta, la taza y la mesa difieren entre las dos imágenes. Los detalles pequeños pueden variar, porque la generación no es un experimento píxel a píxel.

### Qué cambia

Solo la luz: luz suave de ventana desde la izquierda en la primera imagen y luz cálida baja desde la derecha en la segunda. Las sombras van en sentido contrario y la taza se percibe de otra manera sobre la mesa. Esa única diferencia es lo que comparas.

### Qué revisar

Busca texto accidental en la libreta, contenido reflejado de la pantalla y tazas adicionales. Después comprueba si el cambio respondió a tu pregunta, por ejemplo, si el material se distingue mejor. Anota otras diferencias en lugar de atribuirlas todas a la frase sobre la iluminación.

## Prompts de texto a imagen para tres destinos

Cada prompt de texto a imagen define un sujeto, un punto de vista y el espacio que necesita el diseño.

### Naturaleza muerta para una historia de producto

*16:9 · Cabecera de artículo*

Elige un sujeto y dos o tres objetos de apoyo, e indica dónde están. Una tetera verde y una taza sobre una mesa clara, situadas a la derecha con luz suave desde la izquierda, dejan libre el lado izquierdo para un titular. Indícalo en el prompt en lugar de añadir más objetos. Comprueba que los objetos no se fusionen entre sí.

![Tetera verde y una taza sobre una mesa clara a la derecha, con luz suave desde la izquierda y espacio libre a la izquierda para un titular](https://cdn.potto.ai/images/text-to-image-teapot-headline-space-1080.webp)

### Ilustración editorial para un tema abstracto

*4:3 · Tarjeta de artículo*

Un tema abstracto necesita una idea visual antes que un prompt largo. Tres grupos de tarjetas de papel ordenados en una secuencia sobre un escritorio se entienden al tamaño de una tarjeta; cinco significados simbólicos no. Pide formas limpias, una dirección de movimiento y ninguna etiqueta escrita; después comprueba si los grupos se ven ordenados o amontonados.

![Tres grupos de tarjetas de papel ordenados en una secuencia sobre un escritorio, dibujados como una ilustración editorial limpia sin etiquetas](https://cdn.potto.ai/images/text-to-image-paper-cards-editorial-1080.webp)

### Una imagen para redes que resiste el recorte

*4:5 · Publicación en redes*

Define un sujeto y una idea, y elige la relación de aspecto según dónde vaya a verse. Un farol de papel brillante en la mitad superior de un encuadre vertical, con una zona inferior limpia para añadir texto después, indica al generador dónde debe estar el interés. Prueba el recorte al tamaño en que se verá y añade los detalles del evento en tu herramienta de diseño.

![Farol de papel brillante en la mitad superior de un encuadre vertical 4:5, con una zona inferior limpia reservada para texto](https://cdn.potto.ai/images/text-to-image-paper-lantern-social-928.webp)

## Cómo usar la generación de texto a imagen

Tres pasos en la tarjeta de creación de arriba.

### 1. Describe la escena

Escribe un prompt de texto a imagen para un sujeto y su entorno en el campo del prompt, que admite hasta 4000 caracteres. Indica el punto de vista, la luz y el espacio que necesita tu diseño. Si importa el texto exacto, prevé añadirlo después en tu diseño, porque las letras integradas en píxeles generados requieren una revisión palabra por palabra.

### 2. Elige el modelo y el formato

Elige [Nano Banana](https://potto.ai/es/nano-banana.md) o [Nano Banana Pro](https://potto.ai/es/nano-banana-pro.md) en el generador de texto a imagen, después una relación de aspecto, HD, 2K o 4K, uno, dos o cuatro resultados, y PNG o JPEG. Configura primero la relación de aspecto, ya que la misma escena se distribuye de forma distinta en un encuadre cuadrado y uno horizontal. Añade imágenes de referencia solo cuando las palabras no basten.

### 3. Genera y compara

Una imagen HD con Nano Banana cuesta 23 créditos y una imagen HD con Nano Banana Pro cuesta 45; cambiar el modelo, la resolución o la cantidad modifica la estimación de créditos que aparece en Generar. Revisa la composición completa y un detalle crítico a tamaño completo; después descarga o cambia una opción y vuelve a intentarlo.

## Qué hace el generador de texto a imagen con tu prompt

Cuatro aspectos que controla un prompt escrito y cómo comprobar cada uno en el resultado.

### Describe la escena, no una etiqueta de estilo

Un prompt de texto a imagen funciona mejor cuando define un sujeto, dónde está y qué lo rodea. «Una tetera verde y una taza vacía sobre una mesa clara» da al modelo elementos que distribuir; una lista de adjetivos no. El campo del prompt permite incluir detalles sin escribir un bloque interminable.

- Primero, un sujeto y su entorno
- Detalles de apoyo junto al sujeto, no una lista larga

![Tetera verde y una taza vacía sobre una mesa clara, generadas a partir de un prompt de texto](https://cdn.potto.ai/images/text-to-image-teapot-single-subject-1080.webp)

*Prompt de naturaleza muerta con un solo sujeto*

### Define la luz y la posición de la cámara

La luz y el punto de vista cambian una imagen más que los objetos adicionales. La luz suave de ventana desde la izquierda, un ángulo bajo o un encuadre horizontal con espacio vacío a un lado dan al generador de texto a imagen una dirección clara. Cambia uno de estos aspectos cada vez y compara los resultados para ver qué hizo cada frase.

- Indica la dirección y la suavidad de la luz
- Indica dónde debe quedar el espacio vacío

![Dos resultados de un prompt de texto a imagen iluminados desde lados opuestos](https://cdn.potto.ai/images/text-to-image-light-opposite-sides-1080.webp)

*El mismo prompt con la luz trasladada al otro lado*

### Elige primero la relación de aspecto y la resolución

Elige una relación de aspecto y una resolución antes de generar. Un encuadre vertical, uno cuadrado y uno horizontal requieren distribuciones distintas de la misma escena; configura la relación de aspecto según dónde vayas a usar la imagen. La estimación de créditos de Generar se actualiza con cada cambio.

- Resolución de HD a 4K
- Elige una, dos o cuatro imágenes

![Una escena de texto a imagen distribuida en relaciones de aspecto horizontal, cuadrada y vertical](https://cdn.potto.ai/images/text-to-image-teapot-three-ratios-1080.webp)

*Una escena preparada para un encuadre horizontal, uno cuadrado y uno vertical*

### Añade una referencia solo cuando las palabras no basten

La generación de texto a imagen parte de palabras y permite añadir hasta 14 imágenes de referencia cuando sea necesario reproducir un objeto real o un aspecto concreto. Indica en el prompt para qué sirve cada referencia. Cuando no adjuntas ninguna, el resultado se construye solo a partir del prompt.

- Hasta 14 referencias por petición
- Indica la función de cada referencia

![Tarjeta de creación con un espacio para imagen de referencia junto al campo del prompt](https://cdn.potto.ai/images/text-to-image-creation-card-reference-slot-1080.webp)

*Imagen de referencia añadida junto al prompt*

## Descubre más de Potto AI

Elige la página que corresponda a lo que necesita ahora la imagen.

- [Imagen a imagen con IA](https://potto.ai/es/image-to-image.md): Empieza con una imagen de referencia que ya tengas.
- [Crear fotos con IA](https://potto.ai/es/ai-photo-generator.md): Describe la luz, el encuadre y los detalles de los materiales como en una foto.
- [Generador de arte con IA](https://potto.ai/es/ai-art-generator.md): Elige una técnica, una paleta y una composición.
- [Generador de personajes con IA](https://potto.ai/es/ai-character-generator.md): Describe un personaje mediante decisiones visibles.
- [Editar fotos con IA](https://potto.ai/es/ai-image-editor.md): Cambia una cosa en una imagen terminada.
- [Generador de imágenes con IA](https://potto.ai/es/ai-image-generator.md): Configura por completo el modelo, la relación de aspecto, la resolución y las referencias.

## Preguntas frecuentes sobre texto a imagen

### ¿Qué es texto a imagen?

La generación de texto a imagen crea una imagen únicamente a partir de una descripción escrita. El prompt puede definir el sujeto, la composición, la luz y el tratamiento sin subir ninguna referencia. Potto AI funciona como generador de texto a imagen con IA: usa el modelo y los ajustes que elijas para crear imágenes que puedes revisar y descargar. El prompt marca una dirección creativa; no garantiza que cada instrucción se refleje con exactitud.

### ¿Qué debe contener un prompt de imagen útil?

Un prompt de texto a imagen debe incluir el sujeto visible, su relación con el entorno, la composición y el tratamiento que necesita el destino de la imagen. Indica una condición relevante, como una zona despejada junto al sujeto. Evita instrucciones contradictorias y detalles que no puedan verse. Haz que la siguiente revisión resuelva un problema observable.

### ¿Puedo generar palabras exactas dentro de una imagen?

Puedes pedir letras, pero verifica cada palabra y su legibilidad en el resultado terminado. Para nombres, fechas, etiquetas exactas o textos largos, coloca texto editable sobre una imagen revisada en tu diseño. Una imagen generada no es un documento de texto editable y una resolución mayor no demuestra que su texto sea correcto.

### ¿Qué ajustes puedo elegir antes de generar?

Elige un modelo, una relación de aspecto, HD, 2K o 4K, uno, dos o cuatro resultados, y PNG o JPEG. El campo del prompt admite hasta 4000 caracteres. Configura primero la relación de aspecto, porque la misma escena se distribuye de forma distinta en un encuadre cuadrado y uno horizontal. El proveedor determina las dimensiones de salida, así que comprueba el tamaño de la imagen descargada antes de usarla en un diseño exigente.

### ¿Cómo corrijo una imagen que se acerca a lo que quiero pero tiene un fallo?

Identifica primero un solo problema: el sujeto es demasiado pequeño, el fondo está recargado, la luz es demasiado dura o el tratamiento es incorrecto. Después cambia solo esa instrucción y conserva el resto del prompt de texto a imagen. Si los objetos son correctos pero su relación no lo es, reescribe qué objeto va delante y qué acción importa. La generación no es un experimento píxel a píxel: anota las demás diferencias en lugar de atribuirlas todas a tu edición.

### ¿Puede la generación de texto a imagen reproducir un producto o una persona reales?

No de forma fiable. Un prompt de texto a imagen crea una escena imaginada; no demuestra que un objeto coincida con la forma, el color, las dimensiones o los materiales de un producto concreto, y un personaje descrito puede variar entre imágenes. Cuando importe el producto o la persona real, añade una imagen de referencia y compara cada resultado con la imagen original. Una referencia o un modelo concreto no fijan la identidad.

### ¿Necesito una cuenta para crear imágenes a partir de texto?

Puedes escribir un prompt y elegir el modelo, la relación de aspecto y la resolución antes de iniciar sesión. Generar abre el diálogo de inicio de sesión y conserva el prompt de texto a imagen y los ajustes mientras accedes a tu cuenta.

### ¿Qué pasa si falla una petición de texto a imagen?

La tarea explica por qué se detuvo y ofrece volver a intentarlo; los créditos reservados se liberan si la petición falla o se cancela. Usa el control de cancelación para detener una petición en curso, ya que salir de la página no la detiene. Reescribir el prompt después de terminar una imagen inicia una petición nueva con un nuevo cargo.

### ¿Cuántos créditos consume la generación de texto a imagen?

Cada imagen cuesta 45 créditos con Nano Banana Pro en HD o 2K, o 23 con Nano Banana en HD; 4K y una mayor cantidad de imágenes cuestan más. El botón Generar muestra el total exacto de tus ajustes antes de confirmar.

## Convierte tu texto en una imagen

Describe el sujeto, la luz y el espacio que necesita tu diseño, y compara los resultados antes de descargar.
