OpenAI lanzó GPT-5.5 — con nombre en clave "Spud" — el 23 de abril de 2026. Según el cofundador y presidente de OpenAI, Greg Brockman, el modelo supone un avance significativo "hacia una computación más agéntica e intuitiva". En términos sencillos: se trata menos de conversar y más de completar tareas en múltiples herramientas y pasos sin que tengas que gestionar cada movimiento.
GPT-5.5 obtiene un 82.7% en Terminal-Bench 2.0 y un 58.6% en SWE-Bench Pro, benchmarks que evalúan flujos de trabajo complejos de línea de comandos y la resolución de incidencias reales de GitHub. Mark Chen, Chief Research Officer de OpenAI, lo describió como un modelo que muestra "avances significativos en flujos de trabajo de investigación científica y técnica", con potencial para ayudar en áreas como el descubrimiento de fármacos. Es el modelo agéntico más potente de OpenAI hasta la fecha.
La reacción de la comunidad online ha sido más mesurada de lo que sugieren los comunicados de prensa. Algunos ingenieros lo consideran el primer modelo no perteneciente a Anthropic que merece tomarse en serio en meses. Otros dicen que todavía escucha de forma demasiado literal y alucina más que Claude. Aquí tienes el desglose completo: qué cambia realmente GPT-5.5, dónde se queda corto y quién debería cambiarse.
Resumen rápido
Fecha de lanzamiento | 23 de abril de 2026 |
Nombre en clave | Spud |
Mayor mejora | Programación agéntica, flujos de trabajo de varios pasos, uso de ordenador |
Precios de la API | $5 / $30 por 1M tokens (entrada / salida) |
Disponibilidad | ChatGPT Plus, Pro, Business, Enterprise; API |
¿Qué es GPT-5.5?
GPT-5.5 es el modelo de lenguaje grande más reciente de OpenAI, construido sobre una nueva base con nombre en clave "Spud". Lanzado el 23 de abril de 2026, está disponible en ChatGPT y a través de la API de OpenAI, y fue diseñado con un objetivo diferente al de la mayoría de los modelos anteriores.
En lugar de destacar en preguntas y respuestas de un solo turno, GPT-5.5 está creado específicamente para tareas agénticas: le das una instrucción compleja de varios pasos y el modelo determina el plan, elige las herramientas adecuadas, revisa su propio trabajo y sigue adelante hasta que el trabajo queda realmente terminado. Piensa en la diferencia entre GPT-5.4 y GPT-5.5 así: GPT-5.4 era un becario inteligente que necesitaba instrucciones claras paso a paso. GPT-5.5 se parece más a un contratista competente: le dices lo que quieres y se encarga del cómo.
El modelo admite una ventana de contexto de 1M tokens y es compatible con streaming, llamadas a funciones, salidas estructuradas, búsqueda web, búsqueda de archivos, generación de imágenes, intérprete de código, uso de ordenador y MCP.
Funciones de GPT-5.5: qué cambió realmente GPT-5.5
Entiende la tarea antes y pide menos orientación
El comentario más constante de los usuarios es que GPT-5.5 requiere menos solicitudes de aclaración. McKay Wrigley, desarrollador de IA, lo calificó de "increíble" y dijo que "el nivel de confianza que le tengo para ingeniería es asombroso", señalando que lo elegiría como su único modelo para trabajo de programación si se viera obligado a escoger.
Rory Watts describió la diferencia frente a GPT-5.4 como significativa: "Rápido, eficiente... con bastante facilidad, la mejor experiencia para el trabajo diario que he tenido con un agente. Entiende la intención, rara vez comete errores obvios, excelente con herramientas".
Comparado con GPT-5.4, GPT-5.5:
- Comprende antes los requisitos de la tarea durante la conversación
- Usa herramientas con mayor eficacia en flujos de trabajo de varios pasos
- Revisa su propio trabajo antes de presentar el resultado
- Sigue persiguiendo un objetivo hasta completar la tarea, no solo hasta tener algo que decir
Programación agéntica: Terminal-Bench 82.7%, SWE-Bench Pro 58.6%
GPT-5.5 alcanza un 82.7% en Terminal-Bench 2.0, que evalúa flujos de trabajo complejos de línea de comandos que requieren planificación, iteración y coordinación de herramientas, y un 58.6% en SWE-Bench Pro, que mide la resolución de incidencias reales de GitHub. Según OpenAI, resuelve más tareas de principio a fin en una sola pasada que cualquier modelo anterior.
Las mejoras se ven con mayor claridad dentro de Codex, el asistente de programación con IA de OpenAI. El equipo de Finanzas de OpenAI utilizó Codex para revisar 24,771 formularios fiscales K-1 que sumaban 71,637 páginas, un flujo de trabajo que se completó dos semanas más rápido que el proceso manual del año anterior.
Velocidad sin sacrificar inteligencia
Los modelos de razonamiento anteriores de OpenAI tenían un problema de latencia. GPT-5.5 lo aborda directamente: iguala la latencia por token de GPT-5.4 en servicios reales mientras rinde a un nivel de inteligencia significativamente superior. Para longitudes de prompt típicas en flujos de trabajo agénticos (500–2,000 tokens de contexto), las respuestas empiezan a llegar aproximadamente un 20–30% más rápido que con GPT-5.4.
También utiliza muchos menos tokens para completar tareas equivalentes en Codex, algo importante porque la mayor eficiencia compensa el precio nominal más alto en la mayoría de los casos de uso.
Casos de uso de GPT-5.5: para qué es realmente bueno
Programación agéntica y depuración a escala
GPT-5.5 rinde mejor en tareas de ingeniería bien definidas donde el alcance está claro pero el camino es complejo. Ejemplos reales de los equipos internos de OpenAI:
- Equipo de comunicaciones: Usó Codex para analizar seis meses de datos de solicitudes de participación como ponente, crear un marco de puntuación y riesgo, y validar un agente automatizado de Slack, de modo que las solicitudes de bajo riesgo pudieran gestionarse automáticamente mientras las de mayor riesgo seguían derivándose a personas.
- Equipo de Finanzas: Revisó 24,771 formularios fiscales K-1 (71,637 páginas) en un flujo de trabajo estructurado que excluía información personal y redujo el tiempo de procesamiento en dos semanas.
- Equipo Go-to-Market: Automatizó la generación de informes comerciales semanales, ahorrando entre 5 y 10 horas por semana.
Vale la pena señalarlo: Varios ingenieros dijeron que Codex con GPT-5.5 sigue las instrucciones de forma demasiado literal. Si le das una solicitud escueta o implícita, hace exactamente lo que dijiste, no lo que querías decir. Claude Code actualmente tiene ventaja aquí en inferencia de intención.
Investigación y síntesis de datos
Según Mark Chen, GPT-5.5 muestra avances significativos en flujos de trabajo de investigación científica y técnica. Para usuarios empresariales, las aplicaciones prácticas incluyen:
- Reunir hallazgos de múltiples documentos o fuentes de datos
- Producir informes estructurados con una metodología definida
- Contrastar información a lo largo de un hilo de investigación extenso sin perder contexto
La ventana de contexto de 1M tokens hace que GPT-5.5 sea viable para tareas en las que necesitas mantener simultáneamente en mente una gran cantidad de material: analizar un contrato extenso, sintetizar una revisión bibliográfica o procesar un gran conjunto de datos con una rúbrica coherente.
Automatización empresarial y flujos de documentos
GPT-5.5 puede operar software, crear documentos y hojas de cálculo, y coordinarse entre herramientas para completar trabajo de conocimiento de varios pasos. Para usuarios empresariales no técnicos, esto lo hace útil para tareas que de otro modo requerirían coordinación manual entre aplicaciones.
OpenAI destaca específicamente su capacidad para "moverse entre herramientas hasta que una tarea esté terminada", un cambio significativo respecto a modelos que generan texto y se detienen.
Precios y disponibilidad de GPT-5.5 en 2026
Acceso por plan de ChatGPT:
- GPT-5.5 y GPT-5.5 Thinking: Plus, Pro, Business, Enterprise
- GPT-5.5 Pro: Pro, Business, Enterprise (mayor precisión)
- Codex (impulsado por GPT-5.5): Plus, Pro, Business, Enterprise, Edu, Go
Precios de la API (disponibles desde el 24 de abril de 2026):
Modelo | Entrada por 1M tokens | Salida por 1M tokens |
GPT-5.5 | $5 | $30 |
GPT-5.5 Pro | $30 | $180 |
Batch / Flex | 50% de la tarifa estándar | 50% de la tarifa estándar |
Priority | 2.5× estándar | 2.5× estándar |
GPT-5.5 tiene un precio más alto que GPT-5.4, pero OpenAI informa que las mejoras de eficiencia en tokens en tareas de Codex hacen que el coste real por tarea sea comparable o inferior para cargas de trabajo agénticas. Según la documentación de la API de OpenAI, se admite una ventana de contexto de 1M tokens tanto en los niveles estándar como Pro.
GPT-5.5 frente a competidores: ¿para quién es?
Modelo | Ideal para | A tener en cuenta | Para quién es |
GPT-5.5 | Programación agéntica, automatización de varios pasos, tareas bien definidas | Seguimiento literal de instrucciones, alucinaciones | Desarrolladores que ejecutan pipelines complejos |
GPT-5.5 Pro | Tareas científicas o empresariales de alta precisión | Coste ($180/M tokens de salida) | Equipos de investigación, ML empresarial |
Claude Opus 4.7 | Inferencia de intención, planificación, instrucciones ambiguas | Límites de sesión en planes inferiores | Redactores, estrategas, solicitudes implícitas |
Gemini 3.1 Pro | Tareas de visión, flujos de trabajo multimodales | Más débil en programación agéntica de texto puro | Equipos en Google Workspace |
Según el análisis de LessWrong de Zvi Mowshowitz, esto marca la primera vez en aproximadamente cuatro meses que un modelo no perteneciente a Anthropic representa una competencia seria para casos de uso agénticos y de programación. "Básicamente, todo el mundo piensa que es una actualización sólida".
Tom's Guide probó GPT-5.5 frente a Claude Opus 4.7 en siete categorías y encontró que Claude ganaba en todas, pero elogió la velocidad de GPT-5.5. Muchos usuarios avanzados están adoptando un enfoque híbrido: GPT-5.5 para tareas de ingeniería bien especificadas, Claude para tareas que requieren inferencia de intención o instrucciones ambiguas.
Qué dicen realmente los primeros usuarios sobre GPT-5.5
La recepción en los foros de MacRumors y comunidades de IA ha sido más matizada de lo que sugieren los titulares del lanzamiento.
Lo que los usuarios elogiaron:
- Velocidad: respuesta del primer token notablemente más rápida, especialmente en prompts más largos
- Fiabilidad agéntica: completa tareas de varios pasos sin empujones constantes
- Precisión de programación en problemas bien delimitados
Lo que los usuarios criticaron:
- Tasa de alucinaciones: hace más afirmaciones factuales por respuesta y no siempre señala la incertidumbre como lo hace Claude
- Seguimiento literal de instrucciones: ejecuta exactamente lo que escribiste, no lo que pretendías
- Fatiga del mercado: "Cada vez que respiro, se lanza algún LLM" fue un comentario que captó el sentimiento más amplio
Un comentarista de MacRumors que se cambió de ChatGPT a Claude señaló que estaba "intrigado" por GPT-5.5, pero que por ahora seguía con Claude. Otro dijo que GPT-5.5 era "demasiado conservador a la hora de hacer cambios reales en el código, lo que mejora la eficiencia en tokens pero se produce a costa de la corrección".
La historia de seguridad es más sólida que en lanzamientos anteriores: OpenAI recopiló comentarios de casi 200 socios de acceso temprano de confianza y realizó pruebas específicas en ciberseguridad y biología antes del lanzamiento. El marco completo está documentado en la GPT-5.5 System Card.
Conclusión
GPT-5.5 es una mejora significativa para la programación agéntica y la automatización de varios pasos. Entiende las tareas antes, completa más trabajo en una sola pasada y es mediblemente más rápido que GPT-5.4 sin perder inteligencia. Para desarrolladores que ejecutan pipelines complejos, vale la pena evaluarlo ahora, especialmente para flujos de trabajo basados en Codex.
Para todos los que observan la evolución de la IA, la conclusión más importante es esta: la capacidad de planificar, ejecutar y autocorregirse de forma autónoma en tareas de varios pasos ya es estándar en la frontera. GPT-5.5 no es el único modelo que lo hace, pero es una de las versiones mejor ejecutadas hasta ahora.
Tu recepcionista IA, en vivo en minutos.
Escala tu recepción con una IA que nunca duerme. Solvea atiende consultas ilimitadas en múltiples canales, agenda citas automáticamente en tu calendario y evita oportunidades perdidas las 24 horas.
Preguntas frecuentes
¿Qué es GPT-5.5 y cuándo se lanzó?
GPT-5.5 es el modelo de lenguaje grande más reciente de OpenAI, con nombre en clave "Spud", lanzado el 23 de abril de 2026. Está construido para tareas agénticas: flujos de trabajo de varios pasos que implican planificación, uso de herramientas y ejecución autónoma, en lugar de conversación de un solo turno.
¿Cuánto cuesta GPT-5.5 a través de la API?
GPT-5.5 cuesta $5 por 1M tokens de entrada y $30 por 1M tokens de salida. GPT-5.5 Pro cuesta $30 por 1M tokens de entrada y $180 por 1M tokens de salida. Los precios Batch y Flex están disponibles a la mitad de la tarifa estándar, y el procesamiento Priority a 2.5× estándar.
¿Es GPT-5.5 mejor que Claude Opus 4.7?
Depende de la tarea. GPT-5.5 supera a Claude en benchmarks de programación agéntica bien definidos (Terminal-Bench 82.7%). Claude Opus 4.7 suele preferirse para tareas que requieren inferencia de intención o instrucciones ambiguas. Tom's Guide encontró que Claude ganaba en siete categorías comparativas directas, aunque elogió la velocidad de GPT-5.5. La mayoría de los usuarios avanzados usan ambos.
¿Qué es el nombre en clave "Spud" de GPT-5.5?
"Spud" es el nombre interno del proyecto que OpenAI utilizó durante el desarrollo del modelo base de GPT-5.5. Los nombres en clave son una práctica común en OpenAI y no tienen importancia de producto después del lanzamiento.
¿Puedo usar GPT-5.5 gratis?
GPT-5.5 está disponible en los planes de pago de ChatGPT a partir de Plus ($20/month). No está disponible en el nivel gratuito. El acceso a la API requiere una cuenta de OpenAI con facturación habilitada.
¿Cuál es la diferencia entre GPT-5.5 y GPT-5.5 Pro?
GPT-5.5 Pro ofrece mayor precisión para tareas científicas complejas y de nivel empresarial. Cuesta significativamente más ($30/$180 por 1M tokens frente a $5/$30) y está limitado a los planes Pro, Business y Enterprise. Para la mayoría de los desarrolladores, GPT-5.5 estándar es el punto de partida adecuado.






