Descripción general
Flux Depth Dev es un modelo de generación de imágenes de pesos abiertos construido alrededor de una idea concreta: tus ediciones deben respetar el espacio físico de la foto original. Sube una imagen de referencia, escribe un prompt que describa lo que quieres y el modelo lee la estructura de profundidad de esa escena antes de generar nada. Ese mapa de profundidad se convierte en el esqueleto de la salida, de modo que un sujeto en primer plano se mantiene en primer plano, los elementos del fondo permanecen detrás y los objetos conservan su posición relativa entre sí. En Picasso IA, puedes ejecutar Flux Depth Dev directamente en tu navegador, sin necesidad de instalación ni configuración de cuenta.
Cómo funciona
- Sube la imagen que quieres usar como referencia. El modelo extrae automáticamente un mapa de profundidad de ella, sin necesidad de enmascarado manual ni herramientas aparte.
- Escribe un prompt de texto que describa la salida que quieres: el estilo visual, la iluminación, el entorno o el tratamiento del sujeto que tienes en mente.
- Establece la resolución de salida. Elige 1 megapíxel para resultados de tamaño completo, 0.25 megapíxeles para borradores más rápidos o coincide con la entrada para conservar las dimensiones originales de tu imagen hasta 1440x1440 píxeles.
- Ajusta el valor de guía (predeterminado 10) para controlar con qué literalidad la salida sigue tu prompt, y establece los pasos de inferencia entre 28 y 50 según el equilibrio entre calidad y velocidad que quieras.
- Descarga tu resultado en WebP, JPG o PNG, con calidad de salida ajustable de 0 a 100 para formatos comprimidos.
Preguntas frecuentes
¿Necesito habilidades de programación o conocimientos técnicos para usar esto?
No, solo abre Flux Depth Dev en Picasso IA, ajusta la configuración que quieras y pulsa generar.
¿Es gratis para probar?
Sí, Flux Depth Dev está disponible para ejecutarse en Picasso IA sin necesidad de un plan de pago para empezar. Puedes probarlo directamente en tu navegador y ver los resultados antes de comprometerte con nada.
¿Cuánto tarda en obtener resultados?
Con los 28 pasos de inferencia predeterminados, los resultados vuelven en unos pocos segundos. Aumentar hasta 50 pasos añade detalle y nitidez, pero tarda un poco más. Para iteraciones rápidas, menos pasos funcionan bien como punto de partida.
¿Qué formatos de salida son compatibles?
Puedes descargar las imágenes generadas como WebP, JPG o PNG. WebP es el formato predeterminado y equilibra el tamaño del archivo con la calidad visual. Las salidas PNG no tienen pérdida, por lo que el control deslizante de calidad no tiene efecto en ellas.
¿Puedo personalizar la calidad o el estilo de salida?
Sí. La escala de guía determina con qué cercanía el resultado sigue tu prompt de texto, mientras que los pasos de inferencia afectan al nivel de detalle de la imagen final. Para JPG y WebP, un ajuste de calidad separado de 0 a 100 controla la compresión al exportar.
¿Cuántas veces puedo ejecutar el modelo?
Puedes establecer num_outputs para generar varias variaciones de una sola ejecución, y puedes volver a ejecutarlo tantas veces como necesites, ajustando tu prompt o configuración entre cada intento.
¿Dónde puedo usar las salidas?
Las imágenes que generas no llevan marcas de agua y están listas para usar en trabajo para clientes, publicaciones en redes sociales, visuales de producto o maquetas de diseño. Descárgalas en tu formato preferido y úsalas como consideres.