Nuevas Funcionalidades de ChatGPT: Creación de Imágenes con GPT-4o
ChatGPT, el conocido modelo de inteligencia artificial de OpenAI, ha introducido una función innovadora que permite la creación de imágenes desde cero. Esta herramienta, integrada dentro del modelo multimodal GPT-4o, otorga a los usuarios la habilidad de generar imágenes fotorrealistas y precisas. La función no solo permite crear imágenes completamente nuevas, sino también editar fotografías existentes, todas parte del mismo flujo conversacional de ChatGPT.
Características Principales de la Herramienta
Las funcionalidades de la herramienta de generación de imágenes en GPT-4o incluyen la capacidad para representar texto con precisión, seguir indicaciones detalladas y utilizar la base de conocimientos y el contexto del chat para crear imágenes más completas. Esta capacidad la hace especialmente útil para diseñar logotipos, infografías, gráficos educativos o promocionales.
- Permite el manejo de entre 10 y 20 objetos distintos, superando a otros generadores de imagen actuales.
- Incluye mecanismos de seguridad y trazabilidad mediante metadatos C2PA para identificar el origen de las imágenes.
- Respetuoso con los derechos de autor, OpenAI ofrece un formulario de exclusión para que sus obras no sean usadas en el entrenamiento de la IA.
Implementación de la Herramienta de Creación de Imágenes
La nueva función se lanzará inicialmente para los suscriptores del plan Pro de OpenAI, con un costo mensual de 200 dólares. Sin embargo, está previsto que pronto estará disponible para usuarios de planes Plus y gratuitos, así como para desarrolladores que empleen la API de OpenAI.
Aspectos Técnicos del Modelo GPT-4o
GPT-4o está basado en un enfoque autorregresivo que procesa imágenes secuencialmente, lo cual difiere del tradicional modelo de difusión que crea la imagen en su totalidad desde un principio. Este método permite resultados más profesionales de manera intuitiva, con la capacidad de manejar correctamente la asignación de colores y formas para hasta 20 objetos distintos.
- Personalización de fotos de stock con fondo transparente para diapositivas.
- Creación de imágenes fotográficas de alta calidad, incluyendo precisión en iluminación y texturas.
- Edición y personalización de imágenes existentes como inspiración para decoraciones interiores.
Las pruebas iniciales de la función han mostrado resultados cercanos a las descripciones dadas, aunque ocasionalmente pueden ocurrir errores, como la incorrecta posición del sol durante un atardecer.
Disponibilidad y Futuras Ampliaciones
La herramienta se implementará gradualmente para todos los niveles de suscripción en ChatGPT, incluyendo Sora y los niveles ChatGPT Enterprise y Edu. Este lanzamiento escalonado facilitará el acceso a una amplia gama de usuarios interesados en explorar las capacidades de la generación visual con GPT-4o.
Ejemplo de Uso
Para ilustrar el nivel de detalle de la función, considere un escenario donde se cree una imagen fotorrealista de dos brujas leyendo una señal de tráfico en Williamsburg, Nueva York. Este tipo de ejemplos muestra cómo la herramienta permite realizar creaciones complejas y detalladas.
En conclusión, la ampliación de ChatGPT con capacidades de generación de imágenes mediante el modelo GPT-4o representa un importante avance en la tecnología de inteligencia artificial visual. Gracias a sus detalladas características, seguridad incorporada y respeto por los derechos de autor, es una herramienta poderosa destinada a ser utilizada de manera responsable y ética por profesionales y creadores visuales.
