Producto y modelos
Agents API y GPT-Live-1: qué anuncia OpenAI y qué revisar
El 10 de septiembre de 2026 OpenAI lanzó Agents API en beta pública y GPT-Live-1 para voz. Qué confirman sus páginas, qué cuesta y qué debería revisar una pyme.
- Fecha de la novedad
- Publicada en Rapio
- Fuentes revisadas
- Lectura
- 4 min
- Autoría
- Equipo editorial Rapio
En resumen
- Agents API está en beta pública y GPT-Live-1 disponible en la API desde el 10 de septiembre de 2026. Son productos para desarrolladores, no aplicaciones listas para usar.
- GPT-Live-1 cuesta 0,05 $ por minuto solo por la capa de voz; el modelo de fondo y las herramientas se pagan aparte.
- Las cifras de mejora son de OpenAI y de sus clientes. Antes de usar un agente con acceso a sistemas reales hay que limitar permisos, probar y dejar una salida a una persona.
El 10 de septiembre de 2026 OpenAI publicó dos anuncios en la misma fecha: Agents API, en beta pública, y GPT-Live-1 en la API, un modelo de voz. Los dos van dirigidos a quien construye aplicaciones. Esta nota separa lo que confirman las páginas de OpenAI, el contexto, nuestra lectura para una pyme y lo que no está dicho.
Qué cambia
Hechos confirmados por OpenAI
Agents API (beta pública, disponible para todos los desarrolladores):
- Permite crear y ejecutar agentes en la nube con el arnés de Codex, que OpenAI mantiene. El arnés es la capa que gestiona el contexto, las herramientas y los subagentes.
- El agente puede trabajar en un entorno elegido por quien lo construye: un espacio aislado gestionado por OpenAI, infraestructura propia o la de socios como Cloudflare, Modal, Vercel u Oracle, entre otros.
- Admite herramientas MCP, funciones propias y herramientas integradas como la búsqueda web. Puede repartir el trabajo entre varios subagentes y resume el contexto antiguo cuando la sesión se alarga.
- Según OpenAI, no hay tarifa adicional: se paga por los tokens y las herramientas que use el agente. Durante la beta seguirán cambiando el producto hasta llegar a disponibilidad general.
GPT-Live-1 (disponible en la API desde el 10 de septiembre):
- Es un único modelo que escucha y habla a la vez, en lugar de encadenar reconocimiento de voz, un modelo de texto y síntesis de voz. Gestiona interrupciones y admite llamadas telefónicas.
- Puede delegar el razonamiento y las llamadas a herramientas en un modelo de texto de fondo, como GPT-6 Astra u otro de terceros.
- Cuesta 0,05 dólares por minuto por la capa de voz. El modelo de fondo y el agente se contratan aparte.
- OpenAI ofrece más voces con distintos acentos y dice que ampliará idiomas en los próximos meses.
Datos que son afirmaciones del proveedor
OpenAI cita resultados propios y de clientes: una mejora de 30 puntos en una prueba de conversación simultánea frente a GPT-Realtime-2.1, un modelo anterior de OpenAI, una reducción de casi el 80 % de las interrupciones en una aplicación de idiomas y una mejora de puntuación de 0,71 a 0,85 en una evaluación de un cliente de Agents API. Son cifras que publica el propio proveedor, en condiciones que no conocemos. No las hemos reproducido.
Nuestra lectura
Esto es interpretación de Rapio.
- Son piezas de construcción. Ninguno de los dos productos es una herramienta que una pyme instale y use. Su efecto llegará a las pymes a través de software y de proveedores que los incorporen.
- El coste de voz no es solo el de la voz. Un ejemplo hipotético: un negocio inventado atiende 500 llamadas al mes de 4 minutos. Son 2.000 minutos y, a 0,05 dólares, unos 100 dólares al mes solo por la capa de voz. A eso se suman el modelo de fondo, las herramientas y lo que cobre la telefonía, que las páginas no detallan.
- Más autonomía exige más límites. Un agente con acceso a correo, calendario o clientes puede equivocarse con consecuencias. La guía de automatización con supervisión humana explica cómo definir qué puede hacer solo y qué debe aprobar una persona.
- Un agente de voz con clientes plantea la cuestión de la transparencia. El artículo 50 del Reglamento de IA exige que los sistemas que interactúan con personas las informen de que hablan con una IA, salvo que sea evidente. Cómo se cumple depende del proveedor y de cómo lo despliegues; más en la nota sobre el AI Act y en la guía de atención al cliente.
- Las conversaciones grabadas o transcritas pueden contener datos personales. Conviene decidir qué se guarda, cuánto tiempo y quién accede, con quien lleve tu protección de datos.
Lo que no sabemos
- Cuándo pasará Agents API de beta a disponibilidad general.
- Cuánto costará un agente real, porque depende de tokens, herramientas y entorno.
- Cómo rinde GPT-Live-1 en español y con acentos locales: las páginas hablan de más acentos y de ampliar idiomas, pero no listan el español.
- Si las mejoras que citan los clientes se repiten en otros casos.
Qué hacer
- Si no desarrollas software, no hace falta actuar. Pregunta a tus proveedores si van a usar estas tecnologías y con qué datos.
- Si estás valorando un asistente de voz o un agente, pide una prueba acotada: un caso repetible, con datos no sensibles y sin acciones irreversibles.
- Define antes de empezar los permisos mínimos, los límites de gasto, el registro de lo que hace y una salida manual.
- Calcula el coste con tus volúmenes, incluyendo voz, modelo, herramientas y telefonía, y no solo el precio por minuto.
- Usa la calculadora de ROI con supuestos prudentes antes de decidir.
Fuentes primarias
- Introducing the Agents API (se abre en una pestaña nueva). OpenAI. Consultado el .
- Build more natural voice experiences with GPT-Live-1 in the API (se abre en una pestaña nueva). OpenAI. Consultado el .
- Reglamento (UE) 2024/1689 (Reglamento de Inteligencia Artificial), artículo 50: texto original (se abre en una pestaña nueva). Unión Europea (EUR-Lex). Consultado el .
Revisada según la política editorial de Actualidad IA; no constituye asesoramiento.