GPT-Live de OpenAI: ChatGPT voz que escucha y habla

      OpenAI quiere que hables con ChatGPT, no que le escribas. El 8 de julio lanzó GPT-Live, una nueva generación de modelos de voz. La compañía dice que hacen que hablar con la IA se sienta mucho más cercano a una conversación real. Dos versiones, GPT-Live-1 y un GPT-Live-1 mini más pequeño, llegan a los usuarios de ChatGPT en todo el mundo a partir de hoy.

      El cambio principal está en la arquitectura. GPT-Live funciona en “doble vía”, por lo que puede escuchar y hablar al mismo tiempo. Puede insertar un “mhmm” o un “entendido”, intercambiar rápidamente, o esperar mientras piensas. Los modos de voz más antiguos tenían que esperar a que dejaras de hablar primero. Eso a menudo los dejaba interrumpiendo en el momento equivocado.

      Piensa en el fondo, sigue hablando

      El segundo cambio es la delegación. Cuando una pregunta necesita una búsqueda en la web o un razonamiento más complicado, GPT-Live lo entrega a un modelo más fuerte en segundo plano. Ese modelo es GPT-5.5 en el lanzamiento. GPT-Live sigue conversando mientras espera, luego incorpora la respuesta.

      “Así es exactamente como los humanos interactúan entre sí,” dijo Atty Eleti, líder del producto de voz de ChatGPT, a los reporteros, según CNET. “Mantenemos la conversación en marcha mientras pensamos en el fondo.”

      Una demostración llamó la atención. En las conferencias de prensa, el modelo manejó traducción simultánea en tiempo real, hablando una traducción en curso mientras el presentador hablaba. TechRadar, que mostró la función, la calificó de genuinamente útil. El modelo también responde a una palabra de activación, con el personal de OpenAI usando “Hey Chat” en la demostración.

      Más inteligente y gratis para todos

      OpenAI llama a GPT-Live su modelo de voz más inteligente hasta ahora. Los usuarios pueden elegir un nivel de razonamiento: Instantáneo, Medio o Alto. La voz ahora puede mostrar tarjetas visuales para cosas como el clima, acciones y deportes. La compañía afirma que GPT-Live-1 y el mini superan al antiguo Modo de Voz Avanzado en conversaciones de prueba de cinco a diez minutos. También informa grandes avances en benchmarks para razonamiento científico y búsqueda web agente.

      Más de 150 millones de personas ya utilizan la Voz y Dictado de ChatGPT cada semana, dice OpenAI. GPT-Live-1 se convierte en el predeterminado para suscriptores de Go, Plus y Pro, mientras que los usuarios gratuitos obtienen el mini. Está disponible en iOS, Android y la web, aunque el despliegue puede tardar unos días.

      El problema de sonar humano

      Sonar humano tiene sus pros y sus contras. OpenAI dice que agregó capacitación de seguridad específica para la voz y salvaguardias en tiempo real. Estas pueden dirigir una respuesta, mostrar recursos de crisis, o terminar una conversación en casos de mayor riesgo, con protecciones adicionales para adolescentes. También enfatiza que GPT-Live utiliza voces preestablecidas y no imitará a una persona real.

      Esa precaución es importante. Un modelo que suena como un amigo gana confianza más fácilmente, y también puede engañar más fácilmente. Críticos como Meredith Whittaker de Signal han advertido que los chatbots “no son tus amigos.” El campo también sigue abarrotado. Rivales como ElevenLabs y una ola de startups de agentes de voz persiguen el mismo premio. La carrera más amplia de asistentes llevó a Amazon a reconstruir Alexa.

      Por qué es importante

      Esto ocurre el mismo día en que OpenAI avanzó con un amplio lanzamiento de GPT-5.6, parte de un ritmo de lanzamiento rápido. Durante años, la voz ha servido como un extra conveniente, no como la forma principal en que las personas usan ChatGPT. Con GPT-Live, OpenAI está apostando a que hablar, no escribir, se convierta en lo predeterminado. Si las personas quieren una IA que nunca deja de escuchar es la pregunta abierta.

Другие статьи

Марк Кьюбан: Любимый и Replit могут пережить лаборатории ИИ Марк Кьюбан: Любимый и Replit могут пережить лаборатории ИИ На саммите RAISE Марк Кьюбан утверждал, что инструменты для кодирования атмосферы, такие как Lovable и Replit, могут выжить в условиях конкуренции с Anthropic и OpenAI, если они будут владеть рабочим процессом, а не только кодом. Марк Кьюбан: Любимый и Replit могут пережить лаборатории ИИ Марк Кьюбан: Любимый и Replit могут пережить лаборатории ИИ На саммите RAISE Марк Кьюбан утверждал, что инструменты для кодирования атмосферы, такие как Lovable и Replit, могут выжить в условиях конкуренции с Anthropic и OpenAI, если они будут владеть рабочим процессом, а не только кодом. GPT-Live от OpenAI: голос ChatGPT, который слушает и говорит OpenAI запустила GPT-Live, полный дуплекс голосового ChatGPT, который слушает и говорит одновременно, с живым переводом. Он доступен всем пользователям, в том числе бесплатным. Бесплатный AI-сервер ZML работает на любом основном чипе Бесплатный AI-сервер ZML работает на любом основном чипе Французская компания ZML выпускает ZML/LLMD, бесплатный сервер вывода, работающий на открытом исходном коде ИИ на чипах Nvidia, AMD, Google, Intel и Apple с максимальной скоростью. НАТО привлекает Accenture и Leonardo для создания защищенного облака на сумму 200 миллионов евро НАТО привлекает Accenture и Leonardo для создания защищенного облака на сумму 200 миллионов евро НАТО подписывает семилетний контракт на сумму около 200 миллионов евро с Accenture и Leonardo на создание защищенной облачной инфраструктуры, Защищенной бизнес-сети, для Альянса. Cloudflare и OpenAI запускают пилотный проект для обновления AI-поиска Cloudflare и OpenAI запускают пилотный проект для обновления AI-поиска Cloudflare проводит пилотный проект с OpenAI, чтобы передавать сигналы сети в реальном времени в поиск ChatGPT, что является поворотом для компании, основанной на блокировке ИИ-краулеров.

GPT-Live de OpenAI: ChatGPT voz que escucha y habla

OpenAI ha lanzado GPT-Live, una voz de ChatGPT de dúplex completo que escucha y habla al mismo tiempo, con traducción en vivo. Se implementa para todos los usuarios, incluidos los gratuitos.