ChatGPT ya entiende el vídeo real, siete meses después de que OpenAI lo presentara

OpenAI anunció el reconocimiento de vídeo en abril y ha tardado siete meses en lanzar la versión definitiva, pero ChatGPT será más inteligente que nunca a partir de ahora. El asistente de IA puede detectar objetos del mundo real.
OpenAI ha realizado los cambios más importantes en la interfaz de ChatGPT desde que salió al mercado y ha presentado nuevas funciones como la revisión de código o completar las respuestas con preguntas que considera relevantes para comprender un tema. La compañía de Sam Altman ha anunciado ahora el reconocimiento de vídeo.
El chatbot con IA puede analizar el entorno para ofrecer respuestas más precisas. OpenAI ha trabajado en esta función durante casi siete meses y finalmente ha llegado a los usuarios suscritos a ChatGPT Plus, Team o Pro. El gigante tecnológico anunció esta función en abril y prometió que estaría disponible para los usuarios "en unas pocas semanas", aunque lo ha hecho unos meses después.
La compañía ha anunciado el reconocimiento por vídeo en el evento de presentación el pasado jueves con una pequeña demostración del potencial de esta actualización. La función permitirá que las conversaciones con el chatbot de IA se parezcan lo más posible a las de un humano con la posibilidad de añadir referencias al mundo real.
Si ChatGPT no entiende una indicación relacionada con tu entorno, puedes apuntar con la cámara del móvil a los objetos y el asistente los reconocerá. Este modo de voz avanzado con visión también puede leer el contenido de la pantalla compartida desde el dispositivo que estás empleando.
Greg Brockman, presidente de OpenAI, ha demostrado el potencial de esta función con un experimento. Brockman ha dibujado partes del cuerpo humano en una pizarra y ChatGPT tendría que identificarlas. “La ubicación es perfecta. El cerebro está justo ahí, en la cabeza. En cuanto a la forma, es un buen comienzo. El cerebro es más bien ovalado”, aseguró el asistente de IA.
Esta nueva función se suma a algunas más curiosas como el "modo Papá Noel". ChatGPT permite añadir la voz de Papá Noel de manera predeterminada en el asistente preparándose para la Navidad. Los usuarios pueden activarla desde el nuevo icono de un copo de nieve que aparece junto a la barra de búsquedas de la aplicación.
¿Cómo activar el modo avanzado con voz y visión de ChatGPT?

El modo avanzado de voz con visión se puede activar desde el icono de la cámara que aparece en la parte inferior izquierda de la barra de búsquedas de ChatGPT. Para mostrar el contenido de la pantalla del dispositivo debes presionar el menú de tres puntos y seleccionar la opción "Compartir pantalla".
OpenAI, como sucede con otras compañías como Google, llevan las actualizaciones de forma escalonada a todos los usuarios. La función está activa desde el pasado 12 de diciembre para un pequeño grupo de personas, pero el gigante tecnológico ha confirmado que llegará a todos los dispositivos compatibles a lo largo de la próxima semana.
Los usuarios de Estados Unidos son los primeros en recibir esta función. OpenAI ha confirmado que los suscriptores de ChatGPT Enterprise y ChatGPT Edu no tendrán acceso al reconocimiento por vídeo hasta enero y no ha revelado cuándo llegará esta opción a países de la Unión Europea como España.