OpenAI ha anunciado que su API ahora incluirá nuevas características de inteligencia vocal, diseñadas para ayudar a los desarrolladores a crear aplicaciones que puedan hablar, transcribir y traducir conversaciones con los usuarios.
Entre estas novedades se encuentra el nuevo GPT‑Realtime‑2, un modelo de voz que simula de manera realista la conversación con los usuarios. A diferencia de su predecesor, GPT-Realtime-1.5, este nuevo modelo emplea razonamiento de clase GPT‑5, lo que le permite manejar solicitudes más complejas.
Nuevas funcionalidades de OpenAI
OpenAI también ha introducido GPT‑Realtime‑Translate, una función que proporciona servicios de traducción en tiempo real, manteniendo el ritmo de la conversación. Esta herramienta comprende más de 70 idiomas de entrada y ofrece 13 idiomas de salida.
Además, la compañía ha lanzado la capacidad de transcripción GPT-Realtime-Whisper, que permite a los usuarios convertir voz a texto en tiempo real mientras se desarrollan las interacciones.
Aplicaciones y seguridad de las nuevas herramientas
“Los modelos que estamos lanzando transforman el audio en tiempo real de simples interacciones hacia interfaces de voz que pueden realizar tareas: escuchar, razonar, traducir, transcribir y actuar a medida que avanza la conversación”, comentó la empresa.
Estas actualizaciones son especialmente útiles para empresas que buscan mejorar sus capacidades de atención al cliente. No obstante, OpenAI destaca que estas herramientas también beneficiarán sectores como la educación, los medios de comunicación, eventos y plataformas para creadores.
Si bien estas herramientas parecen ser beneficiosas, también podrían ser susceptibles a abusos. OpenAI ha implementado medidas de seguridad para prevenir el uso indebido de sus nuevas funciones, deteniendo conversaciones que violen las pautas de contenido dañino.
Todos los nuevos modelos de voz están disponibles en la API en tiempo real de OpenAI. Las funciones de traducción y Whisper se cobran por minuto, mientras que GPT-Realtime-2 se factura según el consumo de tokens.
Cuando compras a través de los enlaces en nuestros artículos, podemos ganar una pequeña comisión. Esto no afecta nuestra independencia editorial.


