{"id":3302,"date":"2026-06-30T11:27:33","date_gmt":"2026-06-30T11:27:33","guid":{"rendered":"https:\/\/tucumandevelopers.com\/index.php\/2026\/06\/30\/bidi-1-llega-a-chatgpt-openai-apuesta-por-conversaciones-de-voz-mas-naturales-con-ia\/"},"modified":"2026-06-30T11:27:33","modified_gmt":"2026-06-30T11:27:33","slug":"bidi-1-llega-a-chatgpt-openai-apuesta-por-conversaciones-de-voz-mas-naturales-con-ia","status":"publish","type":"post","link":"https:\/\/tucumandevelopers.com\/index.php\/2026\/06\/30\/bidi-1-llega-a-chatgpt-openai-apuesta-por-conversaciones-de-voz-mas-naturales-con-ia\/","title":{"rendered":"Bidi 1 llega a ChatGPT: OpenAI apuesta por conversaciones de voz m\u00e1s naturales con IA"},"content":{"rendered":"<div>\n<div>\n<div data-id=\"cab6e57\" data-element_type=\"widget\" data-e-type=\"widget\" data-widget_type=\"theme-post-content.default\">\n<p>OpenAI contin\u00faa acelerando la evoluci\u00f3n de ChatGPT y ya trabaja en una nueva generaci\u00f3n de su tecnolog\u00eda de voz. La compa\u00f1\u00eda estar\u00eda preparando el lanzamiento de <strong>Bidi 1<\/strong>, un modelo de conversaci\u00f3n bidireccional capaz de escuchar y hablar de manera simult\u00e1nea, una caracter\u00edstica que promete hacer que las interacciones con la inteligencia artificial sean mucho m\u00e1s fluidas, naturales y cercanas a una conversaci\u00f3n entre personas.<\/p>\n<p>La informaci\u00f3n fue revelada por el portal especializado <strong>TestingCatalog<\/strong>, que identific\u00f3 referencias al nuevo modelo tras analizar el c\u00f3digo interno de la aplicaci\u00f3n de ChatGPT. De acuerdo con el reporte, el despliegue de esta nueva funci\u00f3n podr\u00eda producirse en los pr\u00f3ximos d\u00edas, aunque hasta el momento OpenAI no confirm\u00f3 oficialmente su lanzamiento ni dio detalles sobre sus capacidades.<\/p>\n<h2><span>Un salto en la conversaci\u00f3n por voz<\/span><\/h2>\n<p>Desde la presentaci\u00f3n del <strong>Modo de Voz Avanzado<\/strong> de ChatGPT, OpenAI ha buscado reducir la distancia entre las conversaciones humanas y las mantenidas con una inteligencia artificial. Sin embargo, la llegada de Bidi 1 apunta a resolver una de las principales limitaciones de los asistentes virtuales actuales: la necesidad de esperar a que una persona termine de hablar antes de responder.<\/p>\n<p>Con este nuevo modelo, la IA podr\u00e1 procesar la informaci\u00f3n mientras contin\u00faa hablando, lo que le permitir\u00e1 reaccionar en tiempo real ante interrupciones, cambios de tema o nuevas instrucciones sin necesidad de reiniciar la conversaci\u00f3n.<\/p>\n<p>Esta capacidad acerca la experiencia a un di\u00e1logo natural, donde ambas partes pueden intervenir, hacer pausas o modificar el rumbo de la conversaci\u00f3n sin que la interacci\u00f3n resulte forzada.<\/p>\n<blockquote>\n<p dir=\"ltr\" lang=\"en\">OPENAI \ud83d\udd25: Bidi 1, an upcoming voice model from OpenAI, can sing and generate different sounds too.<\/p>\n<p>Some samples below \ud83d\udc40 <a href=\"https:\/\/t.co\/49DKEfPvZx\">https:\/\/t.co\/49DKEfPvZx<\/a> <a href=\"https:\/\/t.co\/CAf2bT67a1\">pic.twitter.com\/CAf2bT67a1<\/a><\/p>\n<p>\u2014 \ud83d\udea8 AI News | TestingCatalog (@testingcatalog) <a href=\"https:\/\/x.com\/testingcatalog\/status\/2069440678967345390?ref_src=twsrc%5Etfw\">June 23, 2026<\/a><\/p>\n<\/blockquote>\n<h2><span>C\u00f3mo funciona Bidi 1<\/span><\/h2>\n<p>Seg\u00fan la informaci\u00f3n difundida por TestingCatalog, una de las principales innovaciones de Bidi 1 es que puede escuchar mientras genera respuestas de voz.<\/p>\n<p>En la pr\u00e1ctica, esto significa que el usuario podr\u00e1 interrumpir a ChatGPT en cualquier momento y el sistema adaptar\u00e1 inmediatamente su respuesta. Incluso ser\u00e1 capaz de abandonar una tarea para comenzar otra completamente distinta sin necesidad de esperar a finalizar la acci\u00f3n anterior.<\/p>\n<p>Un ejemplo mencionado en las pruebas es el siguiente: si el usuario le pide contar del uno al diez y, mientras lo est\u00e1 haciendo, cambia la instrucci\u00f3n para que cuente hacia atr\u00e1s, el modelo interrumpe instant\u00e1neamente la primera tarea y comienza la nueva sin perder el contexto de la conversaci\u00f3n.<\/p>\n<p>Este comportamiento representa una diferencia importante respecto de muchos asistentes de voz actuales, que suelen completar una respuesta antes de aceptar nuevas \u00f3rdenes.<\/p>\n<h2><span>Conversaciones m\u00e1s naturales<\/span><\/h2>\n<p>Otra de las novedades de Bidi 1 es la incorporaci\u00f3n de se\u00f1ales conversacionales similares a las utilizadas por las personas durante un di\u00e1logo cotidiano.<\/p>\n<p>Cuando detecta una pausa o un cambio en el ritmo del habla del usuario, el modelo puede responder con expresiones breves como \u201cok\u201d o peque\u00f1as confirmaciones que indican que contin\u00faa escuchando, generando una sensaci\u00f3n de interacci\u00f3n mucho m\u00e1s org\u00e1nica.<\/p>\n<p>Adem\u00e1s, la inteligencia artificial ser\u00eda capaz de gestionar mejor las pausas, las interrupciones y los silencios, evitando los tiempos muertos que suelen producirse en los asistentes tradicionales.<\/p>\n<p>Seg\u00fan las pruebas compartidas por TestingCatalog en la red social X, la conversaci\u00f3n mantiene un flujo continuo y pr\u00e1cticamente no presenta interrupciones perceptibles entre las intervenciones del usuario y las respuestas de la IA.<\/p>\n<h2><span>Mejor memoria durante la conversaci\u00f3n<\/span><\/h2>\n<p>Otro aspecto destacado del nuevo modelo es su capacidad para conservar el contexto mientras transcurre el di\u00e1logo.<\/p>\n<p>Esto permitir\u00eda recordar con mayor precisi\u00f3n los temas tratados, interpretar referencias realizadas varios minutos antes y responder de forma coherente incluso cuando la conversaci\u00f3n cambia de direcci\u00f3n varias veces.<\/p>\n<p>De acuerdo con las pruebas realizadas por TestingCatalog, actualmente existir\u00eda un l\u00edmite en el tiempo durante el cual el modelo puede hablar de forma continua, aunque logr\u00f3 contar hasta el n\u00famero 23 sin realizar pausas.<\/p>\n<p>Si bien este comportamiento todav\u00eda podr\u00eda modificarse antes del lanzamiento oficial, ofrece un anticipo de las capacidades que OpenAI est\u00e1 desarrollando para sus futuros asistentes conversacionales.<\/p>\n<h2><span>La estrategia de OpenAI para ChatGPT<\/span><\/h2>\n<p>La posible llegada de Bidi 1 forma parte de una serie de mejoras que OpenAI viene incorporando a ChatGPT durante los \u00faltimos meses.<\/p>\n<p>Recientemente, la compa\u00f1\u00eda centr\u00f3 sus esfuerzos en ampliar la memoria del asistente, permiti\u00e9ndole recordar preferencias e informaci\u00f3n relevante del usuario para ofrecer respuestas m\u00e1s personalizadas. Tambi\u00e9n present\u00f3 GPT-5.5 Instant, una versi\u00f3n optimizada para ofrecer respuestas m\u00e1s r\u00e1pidas y eficientes.<\/p>\n<p>En paralelo, distintos reportes indican que OpenAI tambi\u00e9n estar\u00eda preparando una profunda renovaci\u00f3n de ChatGPT con el objetivo de convertir la plataforma en una aut\u00e9ntica \u201csuperapp\u201d, integrando m\u00faltiples herramientas y servicios dentro de una \u00fanica aplicaci\u00f3n.<\/p>\n<p>Aunque la empresa todav\u00eda no confirm\u00f3 oficialmente la existencia de Bidi 1, las filtraciones anticipan un paso importante en la evoluci\u00f3n de la inteligencia artificial conversacional. Si finalmente llega a ChatGPT, este nuevo modelo podr\u00eda marcar un antes y un despu\u00e9s en la forma en que los usuarios interact\u00faan con asistentes basados en IA, acercando cada vez m\u00e1s la experiencia a una conversaci\u00f3n humana en tiempo real.<\/p>\n<h3><span>Preguntas frecuentes<\/span><\/h3>\n<p><strong>1. \u00bfQu\u00e9 es un modelo de voz multimodal?<\/strong><\/p>\n<p>Un modelo de voz multimodal es un sistema de inteligencia artificial capaz de procesar diferentes tipos de informaci\u00f3n al mismo tiempo, como voz, texto e incluso im\u00e1genes. Esto le permite comprender mejor el contexto y ofrecer respuestas m\u00e1s precisas durante una conversaci\u00f3n.<\/p>\n<p><strong>2. \u00bfPor qu\u00e9 la latencia es importante en los asistentes de voz?<\/strong><\/p>\n<p>La latencia es el tiempo que transcurre entre una pregunta del usuario y la respuesta del sistema. Cuanto menor es ese retraso, m\u00e1s natural resulta la interacci\u00f3n. Reducir la latencia es uno de los principales objetivos de las empresas que desarrollan asistentes basados en inteligencia artificial.<\/p>\n<p><strong>3. \u00bfQu\u00e9 sectores podr\u00edan beneficiarse de los avances en IA conversacional?<\/strong><\/p>\n<p>Las mejoras en los modelos de voz tienen aplicaciones en m\u00faltiples industrias, como atenci\u00f3n al cliente, educaci\u00f3n, salud, comercio electr\u00f3nico, banca y productividad empresarial. Tambi\u00e9n pueden facilitar la accesibilidad para personas con discapacidad visual o motriz.<\/p>\n<p><strong>4. \u00bfEn qu\u00e9 se diferencia un asistente de voz basado en IA de uno tradicional?<\/strong><\/p>\n<p>Los asistentes tradicionales suelen ejecutar comandos espec\u00edficos o responder consultas simples. En cambio, los modelos impulsados por inteligencia artificial generativa pueden mantener conversaciones m\u00e1s complejas, interpretar el contexto, razonar sobre la informaci\u00f3n y adaptarse a diferentes estilos de interacci\u00f3n.<\/p>\n<p><strong>5. \u00bfQu\u00e9 desaf\u00edos enfrenta la inteligencia artificial conversacional?<\/strong><\/p>\n<p>Entre los principales retos se encuentran mejorar la comprensi\u00f3n de distintos acentos e idiomas, reducir errores de interpretaci\u00f3n, proteger la privacidad de las conversaciones y evitar respuestas incorrectas o inventadas. Estos aspectos son claves para lograr una adopci\u00f3n m\u00e1s amplia de la tecnolog\u00eda.<\/p>\n<h3><span>Leer m\u00e1s<\/span><\/h3>\n<ul>\n<li><a href=\"https:\/\/www.itsitio.com\/inteligencia-artificial\/chatgpt-ya-no-quiere-ser-solo-un-chatbot-la-renovacion-que-prepara-openai\/\">ChatGPT ya no quiere ser solo un chatbot: la renovaci\u00f3n que prepara OpenAI<\/a><\/li>\n<li><a href=\"https:\/\/www.itsitio.com\/inteligencia-artificial\/chatgpt-evoluciona-openai-integrara-agentes-autonomos-y-herramientas-de-programacion-en-una-sola-plataforma\/\">ChatGPT evoluciona: OpenAI integrar\u00e1 agentes aut\u00f3nomos y herramientas de programaci\u00f3n en una sola plataforma<\/a><\/li>\n<li><a href=\"https:\/\/www.itsitio.com\/inteligencia-artificial\/chatgpt-openai-memoria-dreaming\/\">ChatGPT aprende a recordar mejor: OpenAI renueva la memoria de su asistente<\/a><\/li>\n<\/ul>\n<p><span><\/span> <span>Visitas:<\/span> <span>112<\/span> <\/p>\n<\/p><\/div>\n<\/div>\n<\/div>\n<p>Fuente: <a href=\"https:\/\/www.itsitio.com\/inteligencia-artificial\/bidi-1-llega-a-chatgpt-openai-apuesta-por-conversaciones-de-voz-mas-naturales-con-ia\/\">Art\u00edculo original<\/a><\/p>\n","protected":false},"excerpt":{"rendered":"<p>OpenAI contin\u00faa acelerando la evoluci\u00f3n de ChatGPT y ya trabaja en una nueva generaci\u00f3n de su tecnolog\u00eda de voz. La compa\u00f1\u00eda estar\u00eda preparando el lanzamiento de Bidi 1, un modelo de conversaci\u00f3n bidireccional capaz de escuchar y hablar de manera simult\u00e1nea, una caracter\u00edstica que promete hacer que las interacciones con la inteligencia artificial sean mucho [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":3301,"comment_status":"open","ping_status":"open","sticky":false,"template":"","format":"standard","meta":{"footnotes":"","jetpack_publicize_message":"","jetpack_publicize_feature_enabled":true,"jetpack_social_post_already_shared":true,"jetpack_social_options":{"image_generator_settings":{"template":"highway","default_image_id":0,"font":"","enabled":false},"version":2}},"categories":[47],"tags":[],"class_list":["post-3302","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-itsitio"],"jetpack_publicize_connections":[],"_links":{"self":[{"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/posts\/3302","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/comments?post=3302"}],"version-history":[{"count":0,"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/posts\/3302\/revisions"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/media\/3301"}],"wp:attachment":[{"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/media?parent=3302"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/categories?post=3302"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/tucumandevelopers.com\/index.php\/wp-json\/wp\/v2\/tags?post=3302"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}