Cómo hacer videos con IA a partir de texto o fotos

Usa texto a video para inventar una escena o imagen a video para animar una foto. Algunos modelos también admiten imágenes, video o audio de referencia. Empieza con una toma corta y comprueba las entradas del modelo elegido.

Para hacer videos con IA, empieza con una toma corta y una acción clara. Desde texto defines la escena y su movimiento. Desde una imagen ya tienes la composición: explica qué se mueve, cómo avanza la cámara y en qué vista termina.

Abrir herramienta

Pasos rápidos

Sigue los pasos desde preparar las entradas hasta revisar el resultado.

Abrir herramienta
  1. 1
    Abre el generador de video, elige un modelo y revisa sus entradas. Selecciona texto, imagen o referencias si están disponibles.
  2. 2
    Con texto, describe el sujeto y la escena sin subir una foto. Para animar una imagen, sube una foto clara; añade otros archivos solo en los campos de referencia compatibles.
  3. 3
    Escribe una acción principal y una indicación de cámara. Por ejemplo: «Mantén la prenda quieta; acerca lentamente la cámara a los botones». Indica qué debe permanecer igual.
  4. 4
    Elige duración, proporción, resolución y audio entre las opciones disponibles. Revisa los créditos antes de Generar; dependen del modelo y de las entradas.
  5. 5
    Abre el resultado en tus creaciones y reproduce el clip entero con sonido. Revisa el inicio, el final, el movimiento y las formas, y descarga la versión elegida.

Usa el modo adecuado para tus materiales

Los modos actuales de texto e imagen de Seedance 2.5 ofrecen 4–30 segundos, 480p/720p/1080p y sonido activado inicialmente. Elige la duración en el control, además de describirla. Revisa el costo tras cambiar ajustes y confirma un precio actualizado si la interfaz lo solicita. Marca de agua y publicación opcional en la galería son ajustes distintos.

Texto a video
El estudio empieza en Seedance 2.5 Text to Video. Úsalo si tienes una idea sin foto inicial. Describe sujeto, lugar, una acción y un movimiento de cámara. Divide un guion con varios lugares en tomas separadas.
Imagen a video
Elige Image to Video y añade una foto nítida. Seedance 2.5 acepta una imagen inicial y otra final opcional; no son simples referencias de estilo. La proporción auto sigue a la primera foto: prepara el recorte de destino antes de subirla.
Medios de referencia
Otros modos pueden aceptar imágenes, video o audio y tareas de creación, edición o extensión. Revisa los campos disponibles en el modelo elegido; no equivalen al modo de primer fotograma ni a un editor de montaje.

Separa la acción del sujeto y la cámara

Estas propuestas breves son alternativas a las instrucciones archivadas. Prueba primero una duración compatible de 5–10 segundos.

Escena desde texto

Una tortuga marina pequeña nada con calma sobre un arrecife poco profundo en agua turquesa. La cámara avanza despacio a su lado, a la altura de sus ojos. Aletas con movimiento suave y luz ondulante. Una sola toma continua que termina con la tortuga visible en una vista más amplia.

Elige una proporción horizontal como 16:9. Si activas sonido, pide el ambiente submarino en otra frase.

La cámara muestra una prenda

Mantén la prenda extendida e inmóvil. Acerca lentamente la cámara desde arriba hacia el cuello y los botones; termina en un detalle claro del tejido. Conserva el estampado de hojas, las costuras y la posición de los botones. Luz estable de ventana y una toma continua.

Sube la foto en Image to Video. Puedes llamar mameluco a la prenda en México o pelele en España; la referencia visual evita depender solo del nombre. Usa una foto vertical para obtener un clip vertical.

Ejemplos del tutorial (con prompts y configuración)

Compara los ejemplos, sus entradas disponibles y los ajustes registrados.

Ejemplo 1

Texto a video: una tortuga en el arrecife

Cómo usar este ejemplo

Estos clips revisados se crearon en Gemini, sin indicación del modelo exacto. Ilustran los procesos, no el rendimiento de un modelo concreto de BabyVideo. La tortuga usa solo texto; la prenda incluye su foto original. Compara el movimiento completo y los detalles.

Configuración (usada en este ejemplo)
Relación de aspecto
16:9
Resolución
720p
Duración
10

Palabras clave del prompt

A young sea turtle swims calmly through a sunlit shallow coral reef. Track gently beside it at turtle eye level as it makes natural alternating flipper strokes, passes a golden coral arch and enters bright turquoise water. Stable shell markings and realistic anatomy, delicate suspended particles, rippling sunlight and tiny distant fish. End on a peaceful wider reef view with the turtle visible. One continuous ten-second landscape shot. No people, text, duplicated limbs or cuts. Soft underwater ambience and gentle original piano notes.

Ver toda la trayectoria
La tortuga aparece en un archivo horizontal de 1280 × 720 y unos diez segundos. Sigue silueta, aletas y marcas del caparazón hasta la vista final más amplia. No hay foto de entrada: un primer fotograma convincente no demuestra que todo el movimiento sea estable.
Abrir herramienta
Ejemplo 2

Imagen a video: detalles de una prenda

Cómo usar este ejemplo

Estos clips revisados se crearon en Gemini, sin indicación del modelo exacto. Ilustran los procesos, no el rendimiento de un modelo concreto de BabyVideo. La tortuga usa solo texto; la prenda incluye su foto original. Compara el movimiento completo y los detalles.

Entradas
Entradas 1
Entradas 1
Configuración (usada en este ejemplo)
Relación de aspecto
9:16
Resolución
720p
Duración
10

Palabras clave del prompt

Animate this cream cotton baby onesie photograph into a premium babywear product video. Keep the garment flat and still, preserving its sage leaf print, wooden buttons, linen backdrop and daisy. Slowly push the overhead camera toward the neckline and upper buttons to reveal the cotton texture. Warm window light and soft natural shadows. One continuous ten-second portrait shot. No people, hands, moving sleeves, new objects, text or logos. Quiet room ambience and gentle acoustic music.

Un detalle de la prenda, no siempre la vista completa
El video de 720 × 1280 dura unos diez segundos. La foto muestra la prenda crema completa sobre lino junto a una margarita. La cámara termina cerca del cuello, estampado y botones de madera; ese acercamiento recorta intencionadamente la prenda.
Comparar con el original
Pausa al principio, a mitad y al final para revisar costuras, estampado y botones. Es una demostración de producto ficticio creada con Gemini, sin modelo exacto expuesto; no acredita la conservación exacta de un producto real por un modelo del estudio.
Abrir herramienta

Comprueba movimiento, final y sonido

Deformaciones
Reduce la acción o el movimiento de cámara y vuelve a la foto limpia. Mantén modelo, duración e imagen para comparar una sola modificación. Subir resolución no arregla por sí solo una forma que se dobla.
Cortes o final apresurado
Pide una toma continua y una vista final clara. Quita cambios de escena que no caben en el tiempo elegido. Si solo falla el final, recorta el archivo descargado antes de decidir otra generación.
Audio inesperado
Escucha el archivo completo y confirma la compatibilidad y el interruptor de audio. Pedir diálogo no garantiza las palabras, voz o sincronía exactas. Sustituye o añade pistas en un editor cuando haga falta.

Monta las tomas que ya funcionan

Para una secuencia de producto, prepara vista general, detalle y cierre. Genera las tomas necesarias por separado y guarda referencia, instrucción, modelo y ajustes. Después descárgalas, recorta los tramos débiles y ordénalas en un editor de video. Añade allí subtítulos, logotipo y mensaje final.

Prueba el archivo exportado en un teléfono: encuadre, textos, inicio, final y volumen. Conserva clips sin subtítulos para reutilizar las imágenes en versiones de México o España cambiando el vocabulario y la locución cuando proceda, sin regenerar solo por una corrección de texto.

Consejos

  • Si los objetos se deforman, simplifica el movimiento y estabiliza la cámara. Cambia una instrucción cada vez para comparar.
  • El clip generado es una toma inicial. Usa un editor para recortar, unir escenas o añadir subtítulos antes de compartir.

Preguntas frecuentes

¿Puedo generar un video sin foto?▼
Sí, con un modelo que admita texto a video. Imagen a video necesita una imagen; los requisitos de referencias dependen del modelo.
¿Todos los videos incluyen sonido?▼
No. El audio y sus controles dependen del modelo. Revisa la opción disponible y escucha el resultado; pedir sonido en el prompt no garantiza una pista de audio.
¿Por qué no aparece 9:16 en Seedance Image to Video?▼
Ese modo utiliza auto y sigue la proporción de la primera imagen. Prepara una foto vertical. Texto a video y otros modelos ofrecen controles diferentes.
¿Una instrucción crea todo el montaje final?▼
Genera un clip, pero el estudio no monta automáticamente una secuencia con subtítulos y marca. Planifica tomas y termina el montaje en un editor.
¿La página en español traduce el audio?▼
No. Pide el idioma deseado si el modelo admite voz y comprueba el resultado. Para usar palabras grabadas concretas, elige un flujo compatible con audio de entrada.

¿Listo para generar?

Elige tus propias entradas y revisa los ajustes disponibles antes de generar.

Cómo hacer videos con IA a partir de texto o fotos