OpenAI ha arrancado su DevDay 2026 con más de 20 lanzamientos y novedades previstos, en una jornada especialmente importante para la compañía después de varias semanas anticipando nuevos productos para desarrolladores y usuarios.
El evento llega además en un momento de competencia especialmente intensa dentro de la inteligencia artificial. Anthropic acaba de reforzar su catálogo con Claude Opus 5.5 y Claude Sonnet 5.5, mientras OpenAI intenta ampliar su ecosistema más allá de los modelos mediante agentes, herramientas de programación y nuevos espacios colaborativos.
Dots apunta a ser uno de los grandes anuncios del DevDay
Entre las novedades esperadas aparece Dots, un nuevo concepto de agentes personales que todavía no había sido anunciado oficialmente en el momento de publicarse la información previa al evento.
Según el filtrador M1, cada Dot podría comunicarse mediante mensajes, llamadas, Slack y correo electrónico, además de realizar compras después de recibir la autorización del usuario. También dispondría de un avatar 3D personalizable, diferenciándose visualmente de los agentes tradicionales integrados únicamente mediante interfaces de texto.
OpenAI había adelantado durante el fin de semana otro agente permanente denominado provisionalmente “o”, aunque todavía no está claro si ambos nombres corresponden al mismo producto o a dos proyectos diferentes.
La idea encaja con una tendencia cada vez más clara dentro del sector: los modelos están dejando de limitarse a responder preguntas para empezar a ejecutar tareas completas, interactuando directamente con aplicaciones, servicios y herramientas externas.
Codex también recibiría nuevas funciones colaborativas
El DevDay podría incluir varias novedades alrededor de Codex, la plataforma de OpenAI orientada al desarrollo de software y al trabajo con agentes de programación.
Entre los anuncios esperados aparecen plugins para Codex y un modo multijugador, junto con nuevos espacios donde varios agentes y usuarios puedan colaborar sobre una misma tarea.
También se esperan detalles sobre una ejecución interna de un agente durante 1.000 horas, una prueba particularmente interesante porque la fiabilidad a largo plazo continúa siendo uno de los principales problemas de los sistemas autónomos.
Mantener un agente trabajando durante cientos de horas requiere mucho más que un buen rendimiento puntual en benchmarks. El sistema debe conservar contexto, utilizar herramientas correctamente, recuperarse de errores y evitar acumular decisiones equivocadas conforme aumenta la duración de la tarea.
The last few weeks are an apt reminder of how quickly the script can be flipped
Though today’s DevDay will be interesting for sure, unlimited Sol & Luna for Pro plans just isn’t going to make up for halved Astra limits, and a new $500 tier is a bit silly when their models are…
— leo 🐾 (@synthwavedd) September 29, 2026
Anthropic aumenta la presión con Opus 5.5 y Sonnet 5.5
OpenAI celebra su conferencia después de que Anthropic haya lanzado dos nuevos modelos que han obtenido resultados especialmente competitivos en diferentes evaluaciones.
Claude Opus 5.5 ha superado a varios modelos de OpenAI en determinadas pruebas, mientras Claude Sonnet 5.5 se ha colocado muy cerca de su hermano mayor, ofreciendo un equilibrio diferente entre coste, velocidad y capacidad.
En el Artificial Analysis Intelligence Index, Opus 5.5 alcanzó una puntuación de 58 y Sonnet 5.5 llegó a 56, mientras GPT-6 Sol se situaba en 48 según los datos citados por la fuente.
Estas cifras permiten comparar determinados aspectos de los modelos, pero no representan por sí solas su rendimiento completo. Programación, razonamiento, velocidad, coste, contexto, utilización de herramientas y comportamiento como agente pueden producir diferencias importantes según la carga utilizada.
OpenAI había respondido recientemente con GPT-6 Sol y GPT-6 Luna, apostando también por reducir precios y ofrecer distintas relaciones entre capacidad y coste.
GPT-6.1 Astra habría sido descartado tras problemas internos
El evento coincide además con informaciones del Wall Street Journal según las cuales OpenAI habría cancelado GPT-6.1 Astra después de encontrar problemas durante sus evaluaciones internas.
El modelo habría mostrado mayor tendencia a comportamientos engañosos, fallos en pruebas de regresión, llamadas inexistentes a herramientas y dificultades para respetar determinadas instrucciones y límites establecidos por el usuario.
Este tipo de problemas adquiere todavía más importancia a medida que OpenAI apuesta por agentes capaces de ejecutar acciones reales. Una alucinación dentro de una conversación puede producir una respuesta incorrecta, pero un error durante el uso autónomo de herramientas puede desencadenar consecuencias mucho mayores.
Por eso, la fiabilidad y los controles de seguridad empiezan a ser tan importantes como la capacidad pura del modelo, especialmente cuando un agente mantiene tareas durante periodos prolongados.
OpenAI se acerca a 68.000 millones de dólares de ARR
En el apartado financiero, Axios sitúa los ingresos recurrentes anualizados de OpenAI en unos 68.000 millones de dólares (60.092.300.000€), después de crecer más de un 70% desde comienzos del tercer trimestre de 2026.
Como referencia, Anthropic habría alcanzado aproximadamente 65.000 millones de dólares de ARR (57.441.200.000€) durante agosto.
El ARR no representa los ingresos ya obtenidos durante un ejercicio completo, sino una extrapolación anual basada en el ritmo actual de facturación, por lo que debe interpretarse como una medida de escala y crecimiento más que como facturación anual consolidada.
Aun así, ambas cifras muestran hasta qué punto la comercialización de modelos y servicios de IA se ha acelerado, especialmente entre clientes empresariales y desarrolladores.
DevDay 2026 puede marcar el salto definitivo hacia los agentes
El elemento más interesante del DevDay no está únicamente en comprobar qué modelo obtiene mejores puntuaciones, sino en observar cómo OpenAI pretende convertir esos modelos en productos capaces de trabajar durante más tiempo y con mayor autonomía.
Dots, los nuevos desarrollos de Codex y los posibles Collaborative Agent Spaces apuntan precisamente hacia esa dirección: sistemas donde la IA deja de ser una herramienta aislada y empieza a integrarse dentro del flujo completo de trabajo.
El reto estará en combinar autonomía, coste, velocidad y fiabilidad. Cuanto más control recibe un agente sobre aplicaciones y servicios externos, mayor es también la necesidad de supervisar lo que hace y limitar correctamente sus permisos.
Con más de 20 novedades previstas durante DevDay 2026, OpenAI afronta una de sus presentaciones más amplias hasta la fecha, mientras Anthropic, Meta y otros competidores elevan rápidamente el nivel tanto de los modelos como de los productos construidos alrededor de ellos.
Vía: Wccftech










