El fin del turno forzado
El 8 de julio de 2026, OpenAI lanzó GPT-Live, una familia de modelos de voz construida sobre arquitectura full-duplex — capaz de escuchar y hablar al mismo tiempo. Dos modelos se lanzaron globalmente: GPT-Live-1, predeterminado para planes Go, Plus y Pro; y GPT-Live-1 mini, predeterminado para cuentas gratuitas, reemplazando el Advanced Voice Mode.
El cambio arquitectónico es fundamental. El sistema anterior funcionaba como relevo: transcribir el habla, procesar mediante LLM, convertir de vuelta a audio. Cada turno requería que el usuario dejara de hablar antes de que llegara una respuesta. GPT-Live procesa continuamente — tomando decisiones de interacción muchas veces por segundo sobre cuándo hablar, seguir escuchando, pausar o invocar una herramienta.
Traducción simultánea y delegación en segundo plano
La arquitectura full-duplex habilita dos casos de uso que el sistema anterior no podía ofrecer. Primero: traducción simultánea en tiempo real — al decir "traduce simultáneamente lo que estoy diciendo al inglés", el modelo comienza a traducir mientras el usuario aún habla. En ruedas de prensa, OpenAI demostró la función en vivo y TechRadar la calificó como "genuinamente útil."
Segundo: delegación en segundo plano — cuando una consulta requiere búsqueda web, razonamiento profundo o trabajo complejo, GPT-Live envía la tarea a GPT-5.5 en background y mantiene activa la conversación de voz. "Así es exactamente como los humanos interactúan entre sí", dijo Atty Eleti, líder de producto de ChatGPT Voice. "Mantenemos la conversación mientras pensamos en segundo plano."
Disponibilidad y limitaciones
El lanzamiento cubre iOS, Android y ChatGPT.com. La app de escritorio y los espacios de trabajo Business, Enterprise y Edu quedaron excluidos en el lanzamiento. Sin nuevos precios — GPT-Live está incluido en los planes existentes. OpenAI confirmó planes de llevar los modelos a la API próximamente.
Limitaciones declaradas: GPT-Live está optimizado para idiomas populares, con posibles variaciones de fluidez en otros; no admite voz con video ni pantalla compartida en el lanzamiento.
La apuesta a largo plazo
Más de 150 millones de personas usan ChatGPT mediante voz y dictado, según OpenAI. La empresa ve la voz como la futura interfaz primaria para trabajo complejo de largo horizonte. GPT-Live llega el mismo día que el lanzamiento amplio de GPT-5.6, señalando que el 8 y 9 de julio de 2026 marca un punto de inflexión estratégico en la interacción humano-IA.
Fuentes primarias:
- OpenAI — Introducing GPT-Live: openai.com
- TechCrunch: techcrunch.com
- MacRumors: macrumors.com
- The Next Web: thenextweb.com

