Connect with us

Noticias

Cómo utilizar Midjourney para crear imágenes generadas por IA de alta calidad

Published

on

¿Necesita un logotipo para su negocio o una obra de arte para una presentación? Una opción es utilizar un generador de imágenes de IA como Midjourney. Con este creador de imágenes, usted describe el tipo de imagen que necesita y el sitio muestra cuatro representaciones de alta calidad, que puede ajustar y editar.

Necesita una suscripción paga para utilizar Midjourney. La empresa ha ofrecido pruebas gratuitas en el pasado, pero no de forma constante. Los planes cuestan entre $ 10 y $ 60 por mes y entre $ 96 y $ 576 por año. Cada nivel aumenta la velocidad de las respuestas y ofrece ventajas adicionales. Para probar Midjourney, querrás comenzar con el plan básico para ver qué tan bien funciona para ti.

En el pasado, Midjourney requería que usaras Discord para crear imágenes de IA. Eso requirió mucho juego con indicaciones basadas en texto, un proceso que podría resultar torpe y frustrante, especialmente para los principiantes. Para atraer a una audiencia más amplia, Midjourney lanzó desde entonces un sitio web dedicado que es mucho más fácil y amigable de usar.


Regístrate para mitad de viaje

Para comenzar, diríjase al sitio web de Midjourney y haga clic en el Inscribirse botón en la parte inferior de la página de inicio. Para registrarse se requiere una cuenta de Google o Discord. Si anteriormente creó imágenes a través de Discord, puede usar esa cuenta para recuperar su historial y luego fusionar sus cuentas de Discord y Google para iniciar sesión con cualquiera de ellas.

(Crédito: PCMag/Midjourney)

Después de iniciar sesión en el sitio, una barra lateral a la izquierda muestra pestañas para diferentes secciones. Seleccionar Explorar para ver imágenes que otras personas han creado. Filtre las imágenes eligiendo diferentes categorías en la parte superior, como Aleatorio, Caliente, Día principal (así como Semana principal o Mes principal) y Me gusta.

Explora la biblioteca de imágenes

(Crédito: PCMag/Midjourney)

Haga clic en una imagen que le interese para verla en pantalla completa. También encontrará el mensaje utilizado para generar la imagen, que puede copiar y utilizar como base para su propia imagen. Haga clic en la X para regresar a la galería de imágenes.

Haz clic en una imagen que te interese

(Crédito: PCMag/Midjourney)

Cuando esté listo para crear sus propias imágenes, haga clic en el Crear pestaña de la izquierda. En este punto, se le pedirá que se registre para obtener una de las suscripciones pagas. Haga clic en Únete ahora elija el nivel de suscripción que desee y siga los pasos para pagar y activar su suscripción.

Regístrese para obtener una suscripción

(Crédito: PCMag/Midjourney)


Generar una imagen

En la pantalla Crear, genere una imagen escribiendo un mensaje en el ¿Qué te imaginarás? campo en la parte superior de la página. Añade los detalles necesarios para describir la imagen. También querrás indicar el estilo que deseas, como acuarela, dibujo, anime o fotorrealista. Presione la tecla Enter para enviar su mensaje. En respuesta, se generan cuatro imágenes que, con suerte, coinciden con su descripción.

Crea tu primera imagen

(Crédito: PCMag/Midjourney)


Ajustar una imagen

¿No te gustan los resultados? Modifique la imagen haciendo clic en el icono de configuración de tres líneas a la derecha del mensaje. Aquí puede cambiar opciones como el tamaño, el modelo y la estética de la imagen. Por ejemplo, puedes cambiar la relación de aspecto entre cuadrado, vertical y horizontal. También puedes mover el control deslizante para modificar la estilización, la rareza y la variedad. Pase el cursor sobre una de las opciones en Estética para saber cómo cambiará su imagen.

Modificar la imagen

(Crédito: PCMag/Midjourney)

Una vez que haya realizado los ajustes, copie y pegue el mensaje anterior en el ¿Qué te imaginarás? campo y presione Entrar. Al igual que Copilot de Microsoft y Gemini de Google, Midjourney creará un nuevo conjunto de cuatro imágenes basándose en el mismo mensaje pero utilizando las opciones que hayas ajustado.

Generar una nueva imagen

(Crédito: PCMag/Midjourney)

Pase el cursor sobre una imagen para mostrar opciones para Variar sutil y Variar fuerte. Haga clic en una y Midjourney creará un nuevo lote de cuatro imágenes con variaciones sutiles o fuertes según la que seleccionó y las opciones que eligió.

Crédito: Lance Whitney / Mitad del viaje

(Crédito: PCMag/Midjourney)


Modificar imágenes con acciones de creación

Haga clic en una imagen que le guste y desee modificar más. Luego, esa imagen se abre en una vista más grande. En el lado derecho de la pantalla, aparecen diferentes acciones debajo Acciones de creación. Al pasar el cursor sobre una acción específica se explica lo que hace. El Variar La acción te permite cambiar la imagen de forma sutil o fuerte. En respuesta, Midjourney crea una nueva imagen con cambios sutiles o dramáticos. Para probar este, haga clic Sutil o Fuerte.

Con el Exclusivo acción, puede generar una imagen más grande y más adecuada para descargar o imprimir. Para este, haga clic Sutil o Creativo. Usando el Más acción, puede ejecutar el mismo mensaje nuevamente o ir directamente al editor. También puedes utilizar la imagen, un estilo o un mensaje para revisarlo. Hacer clic Repetición o Editor. Con el Usar acción, puede utilizar la imagen, el estilo o el mensaje original para generar una nueva imagen.

Modifica tu imagen con diferentes acciones

(Crédito: PCMag/Midjourney)

Pruebe algunas de las diferentes acciones. Cada vez que seleccionas una, se genera una nueva serie de cuatro imágenes. Querrá limitar la cantidad de acciones que elija; de lo contrario, terminarás con muchas imágenes nuevas. Cuando haya terminado, regrese a la pantalla Crear para ver los nuevos conjuntos de imágenes.

Recomendado por nuestros editores

Regrese a la pantalla Crear para ver los nuevos conjuntos de imágenes.

(Crédito: PCMag/Midjourney)


Editar una imagen

Elija una imagen en la pantalla Crear. Midjourney tiene un editor incorporado a través del cual puedes realizar más cambios en una imagen. Hacer clic Editor A la derecha. En la pantalla de edición, acerque o aleje la imagen moviendo el Escala control deslizante en la parte superior. Aquí también puede cambiar la relación de aspecto seleccionando uno de los ajustes preestablecidos.

Luego podrá mover la imagen por el lienzo arrastrando el ícono de cuatro flechas en el medio. Por ejemplo, puedes reducir la imagen para agregar más contenido a la izquierda, derecha, arriba o abajo. Cuando termine, haga clic en Entregar y regrese a la pantalla Crear para ver las imágenes recién generadas.

Edita tu imagen

(Crédito: PCMag/Midjourney)

Nuevamente, seleccione la imagen que desea usar para seguir adelante. A continuación, podrá cambiar partes de la imagen según las revisiones de su mensaje. Por ejemplo, puede agregar un nuevo elemento a su imagen borrando la parte que desea cambiar y luego agregando la nueva información al mensaje.

Borra la parte de la imagen que deseas cambiar.

(Crédito: PCMag/Midjourney)

Después de enviar el nuevo mensaje, Midjourney genera un nuevo conjunto de imágenes a la derecha del actual. Haga clic en una de las nuevas imágenes para verla.

Midjourney genera un nuevo conjunto de imágenes.

(Crédito: PCMag/Midjourney)


Descargar y organizar imágenes

Una vez que hayas elegido la imagen que más te guste, ábrela en su propia ventana. Haga clic en Descargar imagen a la derecha y seleccione una ubicación en la que guardar el archivo. Luego, su imagen se descarga como un archivo PNG.

Descargar una imagen

(Crédito: PCMag/Midjourney)

Puede ver y organizar todas las imágenes que ha generado haciendo clic en el Organizar categoría de la izquierda. Haga clic derecho en una imagen específica para acceder a un menú donde puede darle me gusta, ocultar, modificar, copiar o guardar la imagen. Haga clic en Organizar a la derecha para mostrar una barra lateral. Aquí puedes crear carpetas para guardar tus imágenes, filtrar la lista de imágenes según diferentes criterios y jugar con el diseño y el tamaño de la imagen.

Organiza tus imágenes

(Crédito: PCMag/Midjourney)

¿Te gusta lo que estás leyendo?

Matricularse en Consejos y trucos boletín informativo para obtener asesoramiento de expertos para aprovechar al máximo su tecnología.

Este boletín puede contener publicidad, ofertas o enlaces de afiliados. La suscripción a un boletín indica su consentimiento a nuestros Términos de uso y Política de privacidad. Puede darse de baja de los boletines en cualquier momento.

Puntero del boletín

Acerca de Lance Whitney

Contribuyente

Lance Whitney

He estado trabajando para PCMag desde principios de 2016 escribiendo tutoriales, artículos instructivos y otros artículos sobre tecnología de consumo. Más allá de PCMag, he escrito noticias y tutoriales para una variedad de otros sitios web y publicaciones, incluidos CNET, ZDNet, TechRepublic, Macworld, PC World, Time, US News & World Report y AARP Magazine. Pasé siete años escribiendo noticias de última hora para CNET como uno de los reporteros del sitio de la costa este. También escribí dos libros para Wiley & Sons:Windows 8: cinco minutos a la vez y Enséñese usted mismo visualmente LinkedIn.

Lea la biografía completa de Lance.

Lea lo último de Lance Whitney

Continue Reading
Click to comment

Leave a Reply

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Noticias

Las imágenes de estilo Ghibli Studio de Chatgpt muestran su poder creativo, pero plantean nuevos problemas de derechos de autor

Published

on

Las redes sociales se han inundado recientemente con imágenes que parecían pertenecer a una película de Studio Ghibli. Los selfies, las fotos familiares e incluso los memes han sido reimaginados con la paleta suave y pastel característica de la compañía de animación japonesa fundada por Hayao Miyazaki.

Esto siguió a la última actualización de Openai a ChatGPT. La actualización mejoró significativamente las capacidades de generación de imágenes de CHATGPT, lo que permite a los usuarios crear imágenes convincentes de estilo ghibli en solo segundos. Ha sido enormemente popular, tanto así, de hecho, que el sistema se bloqueó debido a la demanda del usuario.

Los sistemas generativos de inteligencia artificial (IA) como ChatGPT se entienden mejor como “motores de estilo”. Y lo que estamos viendo ahora es que estos sistemas ofrecen a los usuarios más precisión y control que nunca.

Pero esto también está planteando preguntas completamente nuevas sobre los derechos de autor y la propiedad creativa.

Cómo el nuevo chatgpt hace imágenes

Los programas generativos de IA funcionan produciendo salidas en respuesta a las indicaciones del usuario, incluidas las indicaciones para crear una imagen.

Generaciones anteriores de generadores de imágenes AI utilizaron modelos de difusión. Estos modelos refinan gradualmente datos aleatorios y ruidosos en una imagen coherente. Pero la última actualización de ChatGPT utiliza lo que se conoce como un “algoritmo autorregresivo”.

Este algoritmo trata las imágenes más como el lenguaje, descomponiéndolas en “tokens”. Así como ChatGPT predice las palabras más probables en una oración, ahora puede predecir diferentes elementos visuales en una imagen por separado.

Esta tokenización permite que el algoritmo separe mejor ciertas características de una imagen, y su relación con las palabras en un aviso. Como resultado, ChatGPT puede crear imágenes con mayor precisión a partir de indicaciones precisas del usuario que las generaciones anteriores de generadores de imágenes. Puede reemplazar o cambiar las características específicas al tiempo que preserva el resto de la imagen, y mejora el tema de larga data de generar texto correcto en las imágenes.

Una ventaja particularmente poderosa de generar imágenes dentro de un modelo de lenguaje grande es la capacidad de recurrir a todo el conocimiento ya codificado en el sistema. Esto significa que los usuarios no necesitan describir todos los aspectos de una imagen con detalles minuciosos. Simplemente pueden referirse a conceptos como Studio Ghibli y la IA entiende la referencia.

La reciente tendencia de Studio Ghibli comenzó con OpenAi en sí, antes de difundirse entre los ingenieros de software de Silcon Valley y luego incluso gobiernos y políticos, incluidos usos aparentemente improbables, como la Casa Blanca, que crea una imagen giblificada de una mujer que llora siendo deportada y el gobierno indio que promueve la narrativa del primer ministro Narendra Modi de una “nueva India”.

Comprender la IA como ‘motores de estilo’

Los sistemas generativos de IA no almacenan información en ningún sentido tradicional. En cambio, codifican texto, hechos o fragmentos de imagen como patrones, o “estilos”, dentro de sus redes neuronales.

Entrenados en grandes cantidades de datos, los modelos de IA aprenden a reconocer patrones en múltiples niveles. Las capas de red inferiores pueden capturar características básicas como relaciones de palabras o texturas visuales. Las capas más altas codifican conceptos o elementos visuales más complejos.

Esto significa que todo (objetos, propiedades, géneros de escritura, voces profesionales) se transforma en estilos. Cuando AI se entera del trabajo de Miyazaki, no almacena marcos reales de Studio Gibli (aunque los generadores de imágenes a veces pueden producir imitaciones cercanas de imágenes de entrada). En cambio, está codificando la “ghibli-ness” como un patrón matemático, un estilo que se puede aplicar a nuevas imágenes.

Lo mismo sucede con los plátanos, los gatos o los correos electrónicos corporativos. La IA aprende “plátano”, “gato” o “correo electrónico corporativo”, patrones que definen lo que hace que algo sea reconocible un plátano, un gato o una comunicación profesional.

La codificación y transferencia de estilos ha sido durante mucho tiempo un objetivo expreso en la IA visual. Ahora tenemos un generador de imágenes que logra esto con una escala y control sin precedentes.

Este enfoque desbloquea posibilidades creativas notables tanto en texto como en imágenes. Si todo es un estilo, entonces estos estilos se pueden combinar y transferir libremente. Es por eso que nos referimos a estos sistemas como “motores de estilo”. Intente crear un sillón al estilo de un gato o en estilo

https://www.youtube.com/watch?v=duwdqsy8ste

La controversia de los derechos de autor: cuando los estilos se convierten en identidad

Si bien la capacidad de trabajar con estilos es lo que hace que la IA generativa sea tan poderosa, también está en el corazón de la creciente controversia. Para muchos artistas, hay algo profundamente inquietante en ver sus enfoques artísticos distintivos reducidos a solo otro “estilo” que cualquiera puede aplicar con un mensaje de texto simple.

Hayao Miyazaki no ha comentado públicamente sobre la tendencia reciente de las personas que usan ChatGPT para generar imágenes en su estilo de animación de fama mundial. Pero él ha sido crítico con la IA anteriormente.

Todo esto también plantea preguntas completamente nuevas sobre los derechos de autor y la propiedad creativa.

Tradicionalmente, la ley de derechos de autor no protege los estilos, solo expresiones específicas. No puedes derechos de autor de un género musical como “SKA” o un movimiento de arte como “Impresionismo”.

Esta limitación existe por una buena razón. Si alguien pudiera monopolizar un estilo completo, sofocaría la expresión creativa para todos los demás.

Pero hay una diferencia entre los estilos generales y los muy distintivos que se vuelven casi sinónimos de la identidad de alguien. Cuando una IA puede generar trabajo “al estilo de Greg Rutkowski”, un artista polaco cuyo nombre se usó en más de 93,000 indicaciones en la difusión estable del generador de imágenes de IA: potencialmente amenaza tanto su sustento como su legado artístico.

Algunos creadores ya han tomado acciones legales.

En un caso presentado a fines de 2022, tres artistas formaron una clase para demandar a múltiples compañías de IA, argumentando que sus generadores de imágenes estaban capacitados en sus trabajos originales sin permiso, y ahora permiten a los usuarios generar trabajos derivados que imitan sus estilos distintivos.

A medida que la tecnología evoluciona más rápido que la ley, el trabajo está en marcha en una nueva legislación para tratar de equilibrar la innovación tecnológica con la protección de las identidades creativas de los artistas.

Cualquiera sea el resultado, estos debates resaltan la naturaleza transformadora de los motores de estilo AI, y la necesidad de considerar tanto su potencial creativo sin explotar como su protección más matizada de estilos artísticos distintivos.

Continue Reading

Noticias

Géminis, abril de 2025: Su horóscopo mensual

Published

on

Para Gemini carismático, adaptable y curioso: esto es lo que puede esperar disfrutar, trabajar y recibir durante todo el mes de abril.

El mes de abril tiene un comienzo lleno de baches cuando la luna creciente de depilación ingresa a su dominio celestial y rápidamente forma un cuadrado tenso con su planeta gobernante retrógrado, Mercurio. Esta fase retrógrada ya está plagada de desgloses de comunicación, retrasos en los viajes y percances tecnológicos. Emparejado con la energía de serptit de la luna creciente de depilación, esta alineación cósmica señala hacia los golpes en el camino en los primeros días del mes. Afortunadamente, esta racha de mala suerte no parece que dure mucho. Para el 5 de abril, una luna del primer trimestre formará un truido mucho más fortuito con mercurio retrógrado.

Videos de Vice

Dos días después, Mercury regresa directamente. Un cambio bienvenido después del estragos que causó en la última mitad de marzo, el regreso de su planeta gobernante a su ruta orbital habitual borra las vías de comunicación, aumenta la claridad mental y hace que los percances de tecnología y viajes sean menos probables. Pero ten cuidado, Géminis: Venus retrógrado seguirá en marcha en este punto. Este evento planetario permanecerá durante casi una semana más que Mercurio retrógrado. Durante este tiempo, este retrógrado puede conducir a una agitación financiera o emocional. Mantén un reloj de cerca en su corazón y billetera durante este tiempo. No dejes que un poco de vista de la luz al final del túnel te tienta a agotar todo lo que tienes que dar antes de alcanzar el final real. Estarás cerca de la línea de meta, pero todavía no.

Para el 10 de abril, la luna gibrosa de depilación forma una oposición directa a su planeta gobernante. Esta fase lunar particular tiende a lograr más conflictos, ya que nos anima a evaluar nuestro entorno y determinar qué tan cerca estamos hacia nuestros objetivos. Ya sea profesional, personal, romántico o de otro tipo, verificar estos objetivos periódicamente puede evitar que tenga que retroceder más allá de la quiebra que ha sido extraviada. Una luna gibosa de depilación con depilación con cera no siempre requiere una liberación o transformación. Pero es el momento oportuno para determinar si necesita uno, lo cual es igual de crítico.

El 13 de abril será un día increíblemente potente en el Cosmos, ya que la luna llena alcanza su máxima resistencia en Libra el mismo día en que Venus regresa directamente. La claridad emocional estará en su punto más alto. Esté atento a las señales universales durante este tiempo, Stargazer. Escucha tu intuición. Estos mensajes sutiles pero importantes a menudo se esconden en los lugares más obvios. Los sentimientos positivos y negativos pueden volverse más intensos bajo la luna llena. Esto ofrece luces verdes y rojas, respectivamente, a medida que continuamos nuestra caminata por nuestros caminos de vida. Asegúrese de prestar atención, particularmente en asuntos del corazón o billetera.

Todos los signos cósmicos apuntan a una mayor creatividad, confianza y progreso personal alrededor del 16 y 17 de abril. En el primero de estos días fortuitos, su planeta gobernante entra a Aries ardientes. Decir lo que piensa será más fácil como resultado. Y, de hecho, este tipo de apertura puede ser una bendición o una maldición, dependiendo de qué tan agudo permitas que tu lengua sea. Presenta tu verdad con coraje. Pero recuerde que la honestidad no siempre tiene que ser cruel. De hecho, el mejor tipo de autenticidad rara vez es, incluso si es algo desagradable.

Una luna gibosa menguante forma un trígono armonioso con mercurio ese mismo día, alentando un cambio hacia la gratitud y la autorreflexión. Estas dos alineaciones que coinciden entre sí parecen sugerir una llamada cósmica hacia la honestidad radical contigo mismo. Frente a este tipo de verdades consigo mismo puede ser difícil, sí. Pero las recompensas a menudo valen la pena el esfuerzo.

Al día siguiente, 17 de abril, Mercurio se une con Neptuno en la cúspide de Piscis y Aries. Esta combinación planetaria fomenta una mayor creatividad, una imaginación más amplia y una apertura a las ideas románticas (tanto en términos de relaciones interpersonales como de amor general a la vida). Capitalice esta energía evaluando y organizando sus ambiciones más altas. Si el dolor de cabeza logístico de la vida cotidiana no estaba en la imagen, ¿qué esperarías lograr? Comience con sus mayores sueños y avance desde allí. Nadie puede culparlo por tener objetivos altos para usted, Géminis. Si lo hacen, ese es su problema para reconciliarse, no el tuyo.

Un sextil favorable entre Mercurio y Plutón alrededor del 20 de abril abre la puerta para avances mentales y emocionales significativos. El último planeta enano típicamente supervisa el cambio y la transformación más importantes en un nivel individual y social. Con la energía comunicativa e intelectual de Mercurio en la mezcla, las estrellas parecen estar suavemente empujándote hacia revelaciones importantes que tendrán efectos positivos en casi todos los aspectos de tu vida. Mantenga un corazón y mente abiertos alrededor de este día.

Nunca debes subestimar la capacidad del Cosmos para sorprenderte para mejor, Stargazer. El mismo sextil entre Mercurio y la luna del último trimestre al día siguiente, el 21 de abril, refuerza aún más la idea de dejar ir y confiar en el universo para encontrar su centro de equilibrio como siempre lo hace.

Las estrellas cambian hacia el descanso, el rejuvenecimiento y la relajación alrededor del 25 de abril. Una conjunción de su planeta gobernante y la disminución de la luna gibosa ese día sirve como un recordatorio crucial. Para mejorar realmente nuestras mentes, cuerpos y espíritus, debemos saber cuándo descansar las tres. Explique algo de tiempo, incluso si es breve, recargar y recalibrar. Puede posponer esta práctica si así lo desea. Pero el universo encontrará una manera de hacer que disminuya la velocidad de una forma u otra.

Terminamos el mes de abril bajo la sombra de la luna nueva en Tauro. Este dominio celestial ya tiene una fuerte inclinación a casa, prefiriendo la estabilidad sobre la espontaneidad y la calma sobre el caos. Siga el reflujo y el flujo natural del cosmos durante este tiempo. Pronto habrá tiempo para la acción, según lo prometido por una luna creciente de depilación que ingresa a su dominio celestial el 29 de abril. Pero en los días previos a esta transición, sobre todo el 27 de abril bajo la luna nueva, las estrellas le instan a que tome las cosas con lento y estable.

Así concluye sus aspectos más destacados mensuales. Para análisis celestiales más específicos, asegúrese de leer su horóscopo diario y semanal también. ¡Buena suerte, Géminis! Nos vemos el próximo mes.

Continue Reading

Noticias

Cómo el generador de imágenes OpenAI 4O reformulan la creatividad

Published

on

El lanzamiento del generador de imágenes 4O de Operai ha encendido una moda de anime infundida con IA.

El desarrollo desencadenó una discusión renovada sobre las capacidades, limitaciones y problemas de derechos de autor de la creación visual asistida por AI-AI. A diferencia de los modelos anteriores de Dall.E (inspirados en el pintor surrealista español Salvador Dalí) que se centró principalmente en la interpretación artística y las transferencias de estilo, el generador de imágenes 4O aparece diseñado para abordar puntos específicos del dolor profesional, particularmente en la representación de texto y la consistencia de la imagen múltiple.

Este desarrollo se produce a medida que el campo se llena cada vez más, con cada plataforma de IA importante que desarrolla especializaciones que revelan tanto el progreso como los desafíos persistentes de la IA generativa.

El panorama competitivo

El mercado de generación de imágenes de IA se ha convertido en un ecosistema especializado donde diferentes herramientas tienen propósitos marcadamente diferentes. MidJourney ofrece a pintores digitales y artistas conceptuales una amplia gama de opciones estilísticas. Sus resultados aparecen regularmente en carteras profesionales e incluso exposiciones de museos, aunque su tendencia hacia el adorno brillante y surrealista puede frustrar a los usuarios que buscan representaciones más realistas.

Gemini 2.5 de Google adopta un enfoque diferente, priorizando la integración con los servicios de Google. Meta AI se especializa en generar imágenes adaptadas a los casos de uso de las redes sociales, aprovechando los vastos datos de los medios y la experiencia en los medios para crear contenidos como memes. Sus sugerencias de colaboración y subtítulos en tiempo real también lo hacen adaptable a fines de comunicación en línea. Grok AI aprovecha la capacidad de generación de imágenes dentro de los chats, facilitando las sesiones iterativas de lluvia de ideas donde las imágenes emergen gradualmente de las discusiones textuales.

En el frente comercial, Adobe’s Firefly ha obtenido la adopción corporativa al ofrecer imágenes legalmente examinadas e integración directa con aplicaciones creativas en la nube, y el agregado de dos preocupaciones principales para los usuarios comerciales.

Aplicaciones de la generación de imágenes de IA

El generador de imágenes 4O de Openai adopta el reciente desarrollo de modelos autorregresivos. En un artículo reciente, investigadores de UC San Diego y Nvidia explica que un modelo autorregresivo toma “tanto imágenes como instrucciones como entradas, y predice que las imágenes editadas hacen los tokens en un paradigma de token de vainilla.

Con el modelo autorregresivo, el nuevo generador de imágenes de abrir AI muestra una fuerza particular en:

Renderización de texto: Demuestra una mejora marcada en la generación de texto legible dentro de las imágenes, una notoria debilidad en modelos anteriores. Los equipos de marketing ahora pueden crear maquetas con logotipos y consignas plausibles, mientras que los educadores informan que el éxito de la generación de diagramas científicos precisos con el etiquetado adecuado.

Consistencia contextual: A diferencia de Dall-E 3, que a menudo luchaba por mantener la consistencia de carácter u objeto en múltiples imágenes, 4O muestra un rendimiento mejorado en la generación en serie. Esto puede ayudar a los diseñadores, animadores, narradores digitales a reducir el tiempo de revisión al crear secuencias de guiones gráficos.

Adherencia rápida: El modelo parece menos propenso a la reinterpretación creativa que hizo que las versiones anteriores fueran impredecibles para el uso profesional.

Los generadores de imágenes AI están transformando cómo las empresas crean y entregan contenido visual a escala. Por ejemplo, Daboon construyó una plataforma de IA generativa que capacita a los narradores de narradores para producir 50,000 imágenes por día, acelerando dramáticamente los flujos de trabajo creativos. Del mismo modo, AYNA utilizó el servicio Azure OpenAI para entrenar modelos de difusión que permiten a las marcas generar sesiones de fotos de catálogo y experiencias de prueba virtuales en minutos, sin pasar el tiempo y el costo de las configuraciones de estudio tradicionales. En el sector minorista de alimentos, Blinkit aplicó AI generativo para crear miles de imágenes de recetas personalizadas vinculadas a su catálogo de productos, mejorando la participación del cliente con contenido visualmente rico y personalizado. Estas aplicaciones demuestran cómo la generación de imágenes de IA está remodelando las industrias al aumentar la velocidad, la personalización y la innovación visual. La División de Marketing Asiático de Unilever aprovecha los activos generados por la IA para las imágenes de productos, informando una reducción del 50% en el tiempo de producción.

Sin embargo, las limitaciones persisten en los generadores de imágenes y videos de IA. Por ejemplo, la interpretación casi perfecta de las caras humanas, los pelos de los animales, las superficies de los objetos, a menudo hacen que las imágenes generadas por IA parezcan plástico y antinatural. Las expresiones faciales exageradas pueden ser más fáciles de detectar, reconocer y, por lo tanto, producidas por los generadores de imágenes. Sin embargo, los humanos reales no resuenan con estas escenas y expresiones demasiado escenificadas. AI generó anuncios, como los comerciales navideños de 2024 de Coca Cola, también provocó controversia sobre su falta de autenticidad.

La paradoja de la creatividad

A medida que estas herramientas democratizan la creación de imágenes, simultáneamente devaltan ciertas formas de arte técnico. El surgimiento de la generación de imágenes de IA desplaza los roles tradicionales al tiempo que crea demanda de nuevas habilidades mejoradas con AI. Según el Informe del Future of Jobs del Foro Económico Mundial 2025, se proyecta que trabajos como diseñadores gráficos, profesionales de publicidad y trabajadores de impresión disminuyan significativamente para 2030, en parte debido a la automatización en la creación de contenido y el diseño visual.

Al mismo tiempo, los roles que respaldan la IA generativa, como especialistas en aprendizaje automático, ingenieros de datos y expertos en transformación digital, se encuentran entre los de más rápido crecimiento. Este cambio señala una transformación más amplia: los trabajadores creativos ahora deben adaptarse adoptando roles híbridos que combinan el juicio humano con las capacidades de IA, a medida que las herramientas generativas se integran cada vez más en las tuberías de producción visual.

Pero los patrones históricos muestran que la interrupción tecnológica generalmente redefine en lugar de reemplazar las profesiones creativas. Así como la fotografía transformó el papel de la pintura en la cultura visual, y los gráficos generados por computadora reforman las películas animadas, la generación de IA parece estar cambiando la creatividad humana hacia los dominios que lucha por replicar: comprensión cultural matizada, resonancia emocional rica e innovaciones más tangibles.

En medio de un potencial de automatización drástica en las industrias creativas, vemos el creciente aprecio público por el arte que conlleva rastros de mano de obra manual. La prima colocada en la animación dibujada a mano en producciones de alto presupuesto; el resurgimiento de la fotografía analógica entre la demografía más joven; y el atractivo persistente de las artesanías artesanales, todos atestiguan los valores únicos del tacto humano, los recuerdos vividos y los detalles minuciosos que ofrecen contextos y significados ricos.

Avanzar

La evolución de la generación de imágenes de IA sugiere que no la transformación utópica ni la amenaza existencial, sino una reconfiguración de la comunicación visual. Los adoptantes profesionales que ven el mayor éxito tienden a 1) implementan políticas de uso claras que especifiquen aplicaciones aceptables. 2) Mantener la supervisión humana para los resultados finales, especialmente en dominios sensibles. 3) Desarrolle flujos de trabajo híbridos que aprovechen la velocidad de AI mientras preservan el juicio humano. 4) Evaluar continuamente las métricas cuantitativas y el impacto cualitativo.

A medida que la tecnología madura, su valor final se determinará no solo por capacidades técnicas, sino por cuán cuidadosamente las organizaciones lo integran en sus procesos creativos y operativos. Los usuarios más exitosos probablemente serán aquellos que vean herramientas como GPT-4O Generator de imágenes no como reemplazos para la creatividad humana, sino como colaboradores que pueden manejar ciertas tareas mientras dejan a otros a especialistas humanos.

Este enfoque matizado reconoce que, si bien la IA puede generar imágenes, el juicio humano sigue siendo esencial para determinar qué imágenes valen la pena generar, y qué significan en última instancia. En un paisaje visual cada vez más sintético donde los generadores de imágenes de IA se vuelven más precisos, el verdadero desafío permanece, ¿pueden volverse más auténticos para las experiencias humanas?

Continue Reading

Trending