Skip to main content

Cada IA tiene sus sesgos, sus modelos y sus formas de interpretar las escenas. Muchas veces coinciden en un porcentaje elevado en cuanto al resultado general, no en los detalles. Y en otras pasa lo siguiente, que parecen herramientas de niveles totalmente distintos.

El prompt utilizado es:

Closeup photography Polar Express train full speed coming to you, surrounding the train a thousands of ghosts and specters, vivid colors, cinematic light, impressive quality, snowing effect, trailing speed

Es decir, queremos un tren del tipo Polar Express acercándose a toda velocidad y rodeado de fantasmas y espectros.

Stable Diffusion a través de Invoke AI y utilizando la última versión de JuggernautXL X nos da esta interpretación:

Abundante color azul, ninguna sensación de velocidad ni de temporal de nieve, y menos aún de espectros o similares.

Veamos que hace Midjourney:

No hay fantasmas. Algo hay en la imagen 3 pero no se aprecia ninguna forma reconocible. La sensación de velocidad es tremenda junto a la nieve. Y la calidad de imagen es muy superior. Con unos pocos ajustes aparecerían los fantasmas sin duda alguna.

Es cierto que Stable Diffusion varía notablemente en los resultados según el modelo utilizado, el scheduler, el nivel de CFG y todos los demás parámetros posibles. Es un poco tedioso probar todas las combinaciones para conseguir un resultado de calidad. En Midjourney podemos ajustar la propia descripción del prompt para conseguir mejoras y tal vez tocando un poco el parámetro de estilo y poco más.

Ahí tienes el prompt. ¿Te animas a tunearlo para mejorarlo? Esperamos tus aportes en cualquiera de la redes sociales o en el grupo de Telegram.