Imágenes realistas y texto legible con los últimos modelos de IA de OpenAI. Pruébelo gratis.
OpenAI ha incorporado su modelo 4o en ChatGPT para permitir la generación de imágenes de forma nativa dentro del entorno del chatbot. Esta actualización elimina la necesidad de utilizar el modelo de generación de imágenes Dall-E de OpenAI como una entidad separada, aunque Dall-E todavía está disponible para quienes lo prefieran. La compañía de IA también ha habilitado su generador de vídeo Sora AI dentro de ChatGPT.

Las nuevas funciones están actualmente disponibles para los usuarios gratuitos de ChatGPT, así como para los usuarios de ChatGPT Plus, Team y Pro. Estas funciones estarán disponibles para los usuarios comerciales y educativos la próxima semana.
Dall-E 3 era anteriormente el complemento de generación de imágenes para suscriptores pagos de ChatGPT. Mientras tanto, quienes quieran probar el generador de forma gratuita pueden hacerlo a través de la versión básica de Microsoft Copilot.
El modelo ha sido elogiado como uno de los mejores generadores de imágenes disponibles, especialmente en su versión de pago. Si bien es beneficioso para todos los usuarios de ChatGPT poder usar la generación de imágenes integrada con el modelo 4o, quienes usan la versión gratuita de ChatGPT deben estar preparados para encontrar algunas limitaciones, como límites máximos de carga de archivos y de análisis de datos, como señaló CNET.
Sin embargo, ChatGPT se beneficiará de imágenes más realistas con texto más claro después de que OpenAI dedicara un año a entrenar a GPT-4o tras su lanzamiento mediante un programa de entrenamiento denominado "Aprendizaje por refuerzo a partir de la retroalimentación humana" (RLHF), según el Wall Street Journal.
Después de anunciar GPT-4o en mayo de 2024, OpenAI contó con un equipo de más de 100 "entrenadores humanos" que escanearon el modelo en busca de errores tipográficos, así como errores comunes en manos y caras, dijo al periódico el investigador principal del proyecto, Gabriel Goh.
El modelo GPT-4o también agregará la capacidad de crear fondos transparentes a ChatGPT. Se espera que esto sea muy útil para usuarios comerciales y creativos, ya que les permitirá crear logotipos u otros íconos, como señaló Jackie Shannon, directora de productos multimedia de ChatGPT, al WSJ.
A pesar de las mejoras implementadas por OpenAI, el modelo GPT-4o actualizado aún presenta algunas deficiencias. Sigue teniendo tendencia a las alucinaciones, una característica común de la IA que aún no se ha resuelto. Mantener la coherencia en la edición sigue siendo un desafío en el entorno de ChatGPT; sin embargo, OpenAI ha prometido actualizaciones rápidas, posiblemente la próxima semana.
Otro problema actual que enfrenta OpenAI es la cuestión de la ética y la legitimidad. La empresa insiste en que su modelo fue entrenado con “datos disponibles públicamente”, así como con datos exclusivos que posee a través de asociaciones con marcas como Shutterstock, señaló el WSJ.
Las imágenes generadas por ChatGPT basadas en el modelo 4o no contendrán marcas de agua de IA. Sin embargo, la compañía señaló que las imágenes incluirán metadatos C2PA que indican que fueron generadas por IA. Este sigue siendo el estándar de la industria.
Los comentarios están cerrados.