• Logo Picasso IALogo Picasso IA
  • Inicio
  • Imagen
  • Video
  • Editar Video
  • Lipsync
  • Mejorar
  • Música
  • Voz
  • Transcribir
  • Chat
  • 3D
  • Escalar
  • Quitar Fondo
  • Efectos
  • AI ToolkitNEW
  • Generaciones
  • Facturación
  • Soporte
  • Cuenta
Seedance 2.5 YA ESTÁ AQUÍ · Nano Banana 2 Y GPT Image 2.5 ILIMITADOS HASTA EL 15 de septiembreMejorar
  1. Colección
  2. Texto a Video
  3. Gemini Omni 1.1

Genera vídeos con audio usando Gemini Omni 1.1

Gemini Omni 1.1 convierte una descripción de texto, una foto fija o un clip de vídeo existente en un vídeo nuevo que incluye su propia banda sonora integrada. En lugar de escribir una escena y luego buscar música o efectos de sonido por separado, describes la acción, el ambiente y el audio que quieres, y el modelo produce un vídeo en el que las imágenes y el sonido coinciden desde el primer fotograma. Esto resuelve el proceso habitual de unir clips de IA silenciosos con audio en un editor independiente. Gestiona bien tres tareas diferentes. Dale solo un prompt y genera un vídeo desde cero en resoluciones de hasta 4K, eligiendo entre un formato panorámico de 16:9 o uno vertical de 9:16 para las redes sociales. Dale una imagen inicial y una imagen final y crea una transición fluida entre ambas, útil para mostrar productos o escenas de antes y después. Dale un vídeo terminado junto con una instrucción escrita como 'haz que el cielo parezca tormentoso' y editará ese detalle específico dejando intacto el resto del metraje. Para un especialista en marketing o creador de contenido, esto significa pasar de una idea a un clip que se puede compartir en un solo paso, sin cambiar entre herramientas independientes para la animación, la voz y el diseño de sonido. Las imágenes de referencia también pueden fijar un personaje u objeto concreto para que mantenga su coherencia entre tomas. Abre Gemini Omni 1.1 en Picasso IA, describe el vídeo que quieres y descarga el resultado cuando termine de renderizarse.

Oficial

Google

3.1k ejecuciones

Gemini Omni 1.1

2026-08-26

Uso comercial

Genera vídeos con audio usando Gemini Omni 1.1

Tabla de contenidos

  • Descripción general
  • Cómo funciona
  • Preguntas frecuentes
  • Costo de Créditos
  • Características
  • Casos de uso
  • Ejemplos
Obtén Nano Banana Pro

Descripción general

Gemini Omni 1.1 convierte una descripción de texto, una imagen inicial o un clip existente en un vídeo terminado con audio sincronizado integrado, todo dentro de Picasso IA. Funciona bien para cualquiera que necesite un vídeo corto rápidamente, ya sea para animar una foto de producto, modificar un detalle de un clip sin volver a grabarlo o crear una escena desde cero con unas pocas frases descriptivas. Describes la toma, el movimiento de cámara, la iluminación, el ambiente y el sonido, y el modelo renderiza un clip acorde, evitando el proceso de ida y vuelta del software de edición tradicional. Un especialista en marketing que prepara un anuncio para redes sociales, un profesor que ilustra un concepto o un cineasta que prueba una lista de planos pueden obtener un borrador utilizable en un solo paso.

Cómo funciona

  • Escribe un prompt que describa la escena, el movimiento de cámara, la iluminación, el ambiente y cualquier audio que quieras en el clip
  • Opcionalmente, sube una imagen inicial para animarla o añade un fotograma final para que el modelo cree una transición fluida entre ambos
  • En su lugar, sube un vídeo existente y describe el único cambio que quieres, como ajustar el clima o la iluminación, mientras todo lo demás permanece intacto
  • Elige una resolución desde un borrador rápido de 360p hasta 4k y selecciona una relación de aspecto de 16:9 o 9:16 para el resultado final
  • Añade imágenes de referencia para mantener la coherencia de un personaje, producto o estilo específico en todo el vídeo generado

Preguntas frecuentes

¿Necesito conocimientos de programación o técnicos para usarlo? No, solo tienes que abrir Gemini Omni 1.1 en Picasso IA, ajustar la configuración que quieras y pulsar Generar.

¿Es gratis para probarlo? Puedes probar Gemini Omni 1.1 en Picasso IA con los créditos incluidos en tu cuenta, por lo que no necesitas realizar una compra por separado antes de crear tu primer clip.

¿Cuánto se tarda en obtener resultados? Un borrador en 360p se renderiza en menos de un minuto, mientras que las resoluciones superiores, como 1080p o 4k, tardan un poco más según la duración y el nivel de detalle de la escena.

¿Qué formatos de salida son compatibles? Cada clip se entrega como un archivo de vídeo estándar con el audio ya mezclado, listo para descargar e insertar directamente en tu línea de tiempo de edición o publicación en redes sociales.

¿Puedo personalizar la calidad o el estilo de salida? Sí, elige una resolución de 360p a 4k, selecciona un formato de 16:9 o 9:16 y añade imágenes de referencia para fijar un personaje específico o un estilo visual.

¿Cuántas veces puedo ejecutar el modelo? Puedes ejecutarlo tantas veces como créditos tengas, por lo que probar varias versiones del prompt antes de decidirte por un clip final es una práctica habitual.

¿Dónde puedo usar los resultados? Los vídeos son tuyos para usarlos en anuncios, contenido para redes sociales, presentaciones o cualquier otro proyecto, sin ninguna marca de agua.

Costo de Créditos

El costo de créditos de este modelo varía según la configuración que elijas. A continuación se muestran los costos por configuración:

ConfiguraciónCréditos
360p10por video
720p30por video
1080p46por video
4k90por video

Características

Todo lo que este modelo puede hacer por ti

Audio integrado

Cada vídeo generado incluye un sonido acorde, por lo que puedes omitir la edición de audio por separado.

Resolución de hasta 4K

Renderiza vídeos nítidos a 360p, 720p, 1080p o 4K completo según tus necesidades.

Animación de imagen a vídeo

Convierte una sola foto en un vídeo en movimiento con movimiento natural.

Interpolación de fotogramas

Proporciona una imagen inicial y otra final para obtener una transición fluida entre ambas.

Modo de edición de vídeo

Cambia un detalle de un clip existente con una instrucción de texto y mantiene intacto el resto.

Coherencia guiada por referencias

Fija un personaje, objeto o estilo a lo largo de un vídeo usando imágenes de referencia.

Relaciones de aspecto flexibles

Alterna entre el formato panorámico 16:9 y el vertical 9:16 para cualquier plataforma.

Modo borrador

Previsualiza rápidamente una escena en 360p antes de renderizar una versión de mayor resolución.

Casos de uso

Genera un vídeo 4K a partir de un prompt de texto que describa la escena, el movimiento de cámara, la iluminación y el audio

Anima una sola foto fija para convertirla en un clip de vídeo en movimiento con sonido acorde

Crea un vídeo con una transición fluida proporcionando una foto inicial y una foto final

Edita un vídeo existente con una instrucción de texto, como cambiar el clima o el fondo, mientras mantienes sin cambios el resto del metraje

Produce un vídeo vertical de 9:16 para historias de redes sociales directamente a partir de una descripción escrita

Mantén la coherencia de un personaje o producto específico en varios clips de vídeo usando imágenes de referencia

Renderiza un borrador rápido en 360p para previsualizar una escena antes de generar la versión final de alta resolución

Añade audio de fondo sin voz a un vídeo especificando 'sin diálogos' en el prompt

Ejemplos

720p
16:9
47.5s

A cinematic drone shot through misty pine mountains at sunrise, gentle wind and birdsong. No dialogue.

Cambiar Categoría

Efectos

Texto a Imagen

Texto a Video

Modelos de Lenguaje Extensos

Texto a Voz

Super Resolución

Sincronización Labial

Generación de Música con IA

Edición de Video

Voz a Texto

Mejorar Videos con IA

Eliminar Fondos