Memoria y traducción en tiempo real: lo que cambia en el día a día con GPT-4o

Además de fusionar texto, voz y visión en un solo modelo, GPT-4o incorpora dos funciones que cambian el uso diario de ChatGPT más de lo que parece a primera vista: memoria entre conversaciones y traducción en tiempo real durante una llamada de voz.

Una IA que recuerda conversaciones anteriores

Hasta ahora, cada conversación con ChatGPT empezaba de cero, sin rastro de lo hablado el día anterior. Con GPT-4o, el modelo puede retener detalles relevantes de interacciones pasadas (preferencias, contexto de un proyecto, decisiones ya tomadas) y aplicarlos en conversaciones posteriores sin que el usuario tenga que repetirlos. En la práctica esto sirve para cosas muy concretas: seguir el hilo de un proyecto que se trabaja en varias sesiones, mantener el mismo tono en textos que se escriben a lo largo de semanas, o evitar explicar el mismo contexto de negocio cada vez que se abre un chat nuevo.

Traducción en tiempo real, sin cambiar de app

La otra novedad que más se nota en el uso diario es la traducción durante una conversación de voz: dos personas que hablan idiomas distintos pueden usar el Modo de Voz de ChatGPT como intermediario, con el modelo traduciendo cada intervención casi al instante gracias a la latencia de audio de GPT-4o, muy por debajo de la que tenían las versiones anteriores. No sustituye a un intérprete profesional en un contexto formal, pero cubre de sobra una conversación de viaje, una reunión informal o una llamada rápida con un proveedor extranjero.

Dónde encaja frente a otros asistentes

La combinación de memoria y voz en tiempo real es uno de los motivos por los que ChatGPT sigue siendo, según varias comparativas entre chatbots, la opción más completa para el usuario medio, por delante de alternativas como Gemini o Grok en el uso cotidiano. Desde el lanzamiento de GPT-4o, OpenAI ha seguido puliendo estas capacidades: meses después llegó o3-pro con mejoras específicas en Voice, señal de que la compañía considera la voz una vía de crecimiento tan importante como el texto.

Requisitos para usarlo

Estas funciones llegaron primero a los suscriptores de ChatGPT Plus, con la aplicación actualizada a la última versión en iOS o Android. La demanda inicial fue alta y OpenAI reconoció problemas puntuales de carga en los primeros días, algo habitual en el estreno de una función que procesa audio en tiempo real a gran escala.

Preguntas frecuentes

¿ChatGPT recuerda todo lo que hablo en cada sesión?
No todo, retiene los detalles que considera relevantes (preferencias, contexto de proyectos) y el usuario puede pedirle que olvide información concreta desde la configuración de memoria.

¿La traducción en tiempo real de GPT-4o sirve para una reunión de negocios formal?
Funciona bien para conversaciones cotidianas, pero para contextos formales con matices legales o técnicos sigue siendo recomendable un intérprete profesional.

¿Necesito ChatGPT Plus para usar estas funciones?
Sí, la memoria y el Modo de Voz avanzado con traducción en tiempo real llegaron primero a los suscriptores de pago.

¿En qué se diferencia esto del lanzamiento técnico de GPT-4o?
El lanzamiento técnico definió la arquitectura multimodal y los benchmarks del modelo; memoria y traducción en tiempo real son funciones concretas que se apoyan en esa base y que no tenían las versiones anteriores de ChatGPT.

Scroll al inicio