OpenAI lanza GPT-Live – modo de voz de nueva generación
OpenAI lanza GPT-Live – modo de voz de nueva generación
OpenAI ha presentado el nuevo modelo GPT-Live, que permite capacidades de conversación en tiempo real. Esta tecnología mejora la comunicación a través de su innovadora arquitectura.
OpenAI lanza GPT-Live – modo de voz de nueva generación
(En realidad, el lanzamiento ocurrió ayer, pero Grok-4.5 lo opacó un poco)
Entonces, ¿qué tenemos:
— El modelo ha sido entrenado para escuchar y hablar simultáneamente. Incluso en el Modo de Voz Avanzado, todavía era un intercambio por turnos, pero ahora la interacción se siente como una conversación en vivo (especialmente si hablas con el modelo en inglés). Lo probamos en traducción simultánea, y suena realmente bien.
— La arquitectura ha sido reemplazada por Full-Duplex. Esto significa que, en lugar de la secuencia "usuario -> procesamiento -> respuesta", el modelo ahora escucha, se actualiza y piensa simultáneamente. Específicamente, cada pocos segundos, toma una decisión: continuar escuchando, interrumpir, llamar a una herramienta, etc.
— Si la solicitud es compleja, el sistema puede redirigir la pregunta a GPT-5.5 (mientras mantiene naturalmente la conversación mientras se prepara la respuesta).
El nuevo modo (+ nuevas voces) se puede probar hoy. El nivel gratuito está implementando GPT-Live-1 mini, mientras que otros ya deberían tener acceso a GPT-Live-1.
Actualmente no hay videos ni demostraciones en pantalla, y algunos idiomas suenan con un acento notable, pero los desarrolladores prometen corregir todo esto gradualmente.
Por qué es importante
АналітикаEsta nueva tecnología mejora significativamente la interacción con la IA, haciendo que la comunicación sea más natural y eficiente. Abre nuevas posibilidades para el uso de interfaces de voz en varios campos.
Debatir en la comunidad
Діліться своїм досвідом та думками з ШІ-розробниками