celebró su DevDay el martes 29 de septiembre en San Francisco y, según su resumen oficial, presentó más de 20 anuncios entre , , modelos y API. Hemos leído ese resumen y las páginas de producto y documentación que enlaza, y aquí nos quedamos con lo que afecta a quien encarga o construye agentes, chatbots y productos SaaS. Para cada novedad separamos qué está disponible, para quién y a qué precio, y al final damos nuestra opinión.
Dots: agentes que siguen trabajando cuando cierras el chat
La novedad más visible son los dots, agentes siempre activos dentro de . Funcionan con , cada uno tiene su propio ordenador en la nube y su navegador, y dice que pueden conectarse a más de 4.000 aplicaciones a través de plugins. Se les habla desde , Slack o Teams, y pueden ponerse a trabajar sin que se lo pidas: lo llama «investigación proactiva» y la limita a herramientas de solo lectura, que no envían mensajes ni cambian contenido. Para las acciones con consecuencias hay reglas propias (actuar, pedir aprobación o bloquear) y una revisión automática, y tareas como cambiar una contraseña siempre quedan en manos de la persona.
En España hay una condición importante. La guía de inicio dice que los dots llegan al plan Pro en mercados que excluyen el Espacio Económico Europeo, Suiza y el Reino Unido, mientras que Business Premium los tiene en todas las regiones donde se ofrece . En Enterprise, Edu y Healthcare están en beta y vienen desactivados hasta que el administrador los activa. Una empresa española que quiera probarlos tendrá que hacerlo con un plan de empresa.
La idea se parece mucho a la de Muse, el agente de Meta: un asistente con su propio entorno que hace tareas, además de contestar. apuesta por la distribución de WhatsApp. coloca su agente donde ya trabajan los equipos (, Slack, Teams) y le da acceso a las aplicaciones de la empresa. Nosotros vemos ahí la diferencia que más va a pesar en las empresas, porque decide quién configura los permisos y quién responde si el agente se equivoca.
GPT-6.1 Sol: casi Astra por una quinta parte
GPT-6.1 Sol es la actualización de . En la API cuesta 2 dólares por millón de de entrada, 0,10 por millón de entrada en y 10 por millón de salida. está a 10 y 50 dólares en la tabla de precios, así que la proporción de un quinto que anuncia cuadra con las tarifas estándar. Está en la API como gpt-6.1-sol y en Work y para Plus, Pro, Business, Enterprise y Edu. En el chat normal de todavía no.
Las cifras de rendimiento son de las propias evaluaciones de . Según su anuncio, en DeepSWE v1.1 (tareas largas de ingeniería de software) iguala a con más o menos una quinta parte del coste, y en OSWorld 2.0 (uso del ordenador), con el razonamiento al máximo, se queda a 2,1 puntos de con alrededor de una séptima parte del coste por tarea. La propia recomienda seguir usando para la investigación científica más difícil.
Para un proyecto con agentes, el cambio de precio pesa más que cualquier benchmark. Con la entrada en caché a 0,10 dólares, un agente que reutiliza mucho contexto entre llamadas sale bastante más barato. Si ya tienes un presupuesto calculado con , merece la pena rehacerlo con Sol y ver qué tareas aguantan el cambio. Explicamos cómo hacer esa cuenta en cuánto cuesta terminar una tarea con un agente, y si los nombres te confunden, en qué significan Astra, Sol, Terra y Luna.
Agents API con computer use
La Agents API está en beta pública desde el 10 de septiembre. Ofrece el mismo arnés de como servicio gestionado por , que se encarga de compactar el contexto en sesiones largas, buscar herramientas, repartir trabajo entre subagentes y conectar servidores MCP. El código puede ejecutarse en un sandbox de , en tu propia infraestructura o con socios como Cloudflare, Vercel, E2B o Modal.
En el DevDay se añadió computer use: el agente maneja un navegador alojado por para probar una web, recoger información o usar una aplicación a través de su interfaz. La documentación pide a la aplicación que gestione cada solicitud de acceso a un sitio y el inicio de sesión cuando la tarea lo necesita, y que verifique el resultado al final. Según el resumen, esta función está en la API y también en y Work para Pro 500 y Enterprise. ha trabajado además con Amazon en Bedrock Managed Agents para ejecutar estos agentes dentro de AWS.
Muchos de los agentes que nos encargan necesitan justo esto: sesiones largas, herramientas propias y un entorno donde ejecutar código. Antes había que construir esa capa a mano. Ahora tiene sentido probar primero la Agents API y reservar el desarrollo propio para cuando haga falta control total sobre cada paso o independencia del proveedor. El arnés de es de código abierto, y eso ayuda a no quedarse atado a un solo proveedor.
Ultrafast y Pro 500
Ultrafast es el nivel de velocidad más alto. El resumen habla de hasta 8 veces más velocidad de generación en (300 tokens por segundo) y hasta 6 veces en la API. Hoy está disponible para ( dice que la versión Ultrafast de llegará pronto), y en la API cuesta 60 dólares por millón de tokens de entrada y 300 por millón de salida, seis veces la tarifa estándar. La guía de Ultrafast añade un detalle que importa en Europa: solo admite residencia de datos en Estados Unidos y procesamiento global, sin endpoints de procesamiento regional en la UE.
En Work y , Ultrafast está en Enterprise y en el nuevo plan Pro 500, de 500 dólares al mes, que según incluye 25 veces el uso de Plus. Pro 100 y Pro 200 siguen existiendo, sin Ultrafast.
Si tu proyecto exige que los datos se procesen en la UE, Ultrafast queda descartado por ahora. Para el resto de casos, la velocidad extra se paga cara y solo compensa cuando una persona espera la respuesta en tiempo real.
Codex en la nube y Codex Security Cloud
Codex ya puede trabajar desde el ordenador, desde el móvil o en la nube. Los entornos de la nube se configuran una vez con los repositorios, las herramientas y los permisos aprobados, y cada tarea sigue trabajando aunque tu portátil esté dormido. Está en Plus, Pro, Business, Healthcare, Education y Enterprise. La app de escritorio suma una vista de revisión de código en la que también puede hacer una primera revisión automática en la nube.
Codex Security Cloud escanea repositorios de GitHub bajo demanda o de forma programada, revisa los commits nuevos y propone parches. Antes de crear el pull request en borrador, la persona revisa el parche. Está en Pro, Business, Enterprise y Edu.
Para el mantenimiento de webs y SaaS de clientes, una revisión de seguridad periódica sobre cada commit nos parece la parte más útil. Eso sí, el parche lo sigue aprobando alguien que conoce el proyecto.
ChatGPT como plataforma: plugins, Space y Pages
Una parte del DevDay va dirigida a quien tiene un producto. Las extensiones de plugins permiten dar al plugin un sitio en la barra lateral, paneles interactivos y visores para los tipos de archivo que maneja tu producto. Con MCP Events, un plugin puede lanzar automatizaciones cuando pasa algo en la aplicación conectada. también ha mejorado el ranking y las recomendaciones de plugins, en el directorio y dentro de las conversaciones. Esa visibilidad orgánica convive ahora con la de pago que contamos en el artículo sobre anuncios y Sponsored Agents en ChatGPT.
Otro anuncio con impacto para un SaaS es Sign in with ChatGPT. Además de iniciar sesión con la cuenta de , los usuarios de Plus y Pro pueden dejar que una aplicación participante use la cuota de su plan para las peticiones de IA, con un límite semanal por aplicación. Para algunas herramientas esto cambia quién paga los tokens.
Para equipos llegan Space y Pages: Space sustituye a la Biblioteca como sitio común de archivos, y las Pages son documentos que se editan entre personas, y el dot de cada uno, y que pueden mantenerse al día con las herramientas conectadas. Están en Pro, Business y Enterprise. En preview limitada está Decisions API, que usa el modelo Luna para responder preguntas con respuestas cerradas y sirve para clasificar contenido, enrutar peticiones o elegir el siguiente paso de un agente.
Qué se ha comentado en X
Hemos revisado medio centenar de publicaciones recientes sobre el DevDay. No las usamos como fuente de datos, solo como termómetro. @srmarcmayol lo resumía así para España: «Si pagas ChatGPT Pro en España, no tienes dots.» La guía de citada arriba lo confirma. @Daniel0x47 ponía el foco en el coste: «La prueba será el costo por tarea resuelta.» Y @technodictAI dejaba un consejo que compartimos: «Before you build on it, check what’s live vs. preview» (antes de construir encima, comprueba qué está disponible y qué sigue en preview).
Qué haríamos ahora
Si ya tienes un agente o un chatbot en producción, recalcula costes con y prueba si sus tareas aguantan el cambio de modelo. Si vas a construir uno nuevo con sesiones largas o uso del navegador, empieza por un prototipo con la Agents API antes de levantar tu propia infraestructura. Y antes de prometer una función a tu equipo o a tus clientes, comprueba que está disponible en tu plan y en tu región: los dots en Pro y Ultrafast con datos en la UE son dos ejemplos de que no todo llega igual a Europa.
Si quieres valorar qué encaja en tu caso, desde un chatbot o agente para tu web hasta un agente que trabaje con tus sistemas, cuéntanos qué necesitas.