Ahora puedes cargar y editar fotos en Gemini.

Resumen:

  • Ahora puedes cargar y editar fotos en Gemini de forma gratuita. Esta función se implementará gradualmente para todos los usuarios, a partir de hoy.
  • Los usuarios también pueden crear y editar imágenes de IA en Gemini a través de indicaciones de texto conversacionales.
  • Google confirma que todas las imágenes generadas por IA en Gemini tendrán una marca de agua visible y una marca de agua digital SynthID invisible.

Finalmente, Google está introduciendo la posibilidad de editar fotos en Gemini a través de indicaciones de texto. Ahora puedes cargar y editar fotos existentes en Gemini a través de chats de texto. Además, puedes crear imágenes de IA con Gemini y duplicarlas para modificar la imagen. La función de edición de fotografías de Gemini se estará implementando gradualmente para todos los usuarios a partir de hoy. Esta nueva función mejora la experiencia del usuario y proporciona potentes herramientas creativas.

Google fue el primero en ofrecer edición de imágenes nativa utilizando el modelo Flash Gemini 2.0 en AI Studio. Probé el modelo en febrero y me sorprendió lo fácil que era editar imágenes de forma conversacional. En respuesta al modelo de generación de imágenes nativas de Google, OpenAI también introdujo la edición y generación de imágenes nativas en ChatGPT.

Esto propició la rápida difusión de la tendencia Ghibli e incrementó el uso de ChatGPT. Ahora, Google ha incorporado funciones nativas de edición de imágenes a su aplicación para consumidores, Gemini. Cabe destacar que se pueden editar imágenes tanto en la aplicación móvil como en la versión web de Gemini. Esta característica convierte a Gemini en un fuerte competidor en el campo de la IA generativa.

Tras comparar la edición de imágenes nativa entre ChatGPT y Gemini , puedo afirmar que Gemini es muy superior a la hora de mantener la coherencia de personajes y escenas entre generaciones. ChatGPT modifica la imagen completa después de cada generación, mientras que Gemini ofrece una consistencia notable. Sin embargo, en la creación de imágenes, ChatGPT supera a Gemini. Esto refleja las diferencias en las arquitecturas de los modelos utilizados.

Ahora necesitamos saber si Google todavía utiliza el modelo basado en difusión de Imagen 3 para generar imágenes o utiliza las capacidades nativas de generación de imágenes de los modelos Gemini. Por cierto, OpenAI utiliza el modelo de IA GPT-4o para crear y modificar imágenes. Este desarrollo ilustra la competencia actual en el campo de la inteligencia artificial.

Aparte de eso, Google dice que una marca de agua digital SynthID invisible está incrustada en todas las imágenes creadas o editadas con Gemini. Además, Google también agregará una marca de agua visible a todas las imágenes creadas con Gemini. Esta medida tiene como objetivo mejorar la transparencia y la rendición de cuentas en el uso de la inteligencia artificial.

Los comentarios están cerrados.