NeuralTrust ha sido reconocido por Gartner → Leer más
Volver

Cursor vs Codex: benchmarks y coste 2026

Roger Howroyd 29 de septiembre de 2026
Compartir
Cursor vs Codex: benchmarks y coste 2026

Última actualización: Septiembre 2026

¿Es Cursor mejor que Codex en 2026?

En la elección Cursor vs Codex, la respuesta depende de dónde quieres que trabaje el agente y de cuántos proveedores de modelos quieres. Cursor, de Anysphere, es un editor nativo de IA con modelos propios (Composer y Grok) y de terceros. OpenAI Codex es un agente para terminal, IDE, escritorio y nube, basado en GPT-6.

Dos hechos cambian la comparativa: SpaceX compró Cursor el 14 de agosto de 2026 y OpenAI dejará de darle modelos el 12 de noviembre. Comparamos benchmarks, precios, flujos y seguridad con fuentes fechadas.

TL;DR: puntos clave

  • Benchmarks: GPT-6 Astra con el agente de Codex lidera la clasificación de Terminal-Bench 4.0 con un 58,2 %. En CursorBench 4.0, el mejor de OpenAI logra un 41,7 % y Grok 4.7 un 46,3 %.
  • Acceso a modelos: OpenAI cerrará su contrato de modelos con Cursor el 12 de noviembre de 2026, según OpenAI. Cursor dice que suponen un 5 % de su tráfico.
  • Precios: Ambos empiezan en 20 $ al mes. Cursor Teams cuesta 40 $ por usuario y ChatGPT Business, con Codex, 25 $ (20 $ en pago anual), según Cursor y OpenAI.
  • Adopción: En 2026, el uso de Codex en el trabajo subió del 3 % al 16 % y el de Cursor bajó del 18 % al 12 %, según JetBrains.
  • Seguridad: Ambos han corregido fallos críticos con CVSS 9,8: DuneSlide en Cursor y la CVE-2025-61260 en Codex CLI.

De un vistazo: diferencias clave en 2026

Cursor (Anysphere, empresa de SpaceX)OpenAI Codex
Modelos propios o por defectoComposer 2.5, Grok 4.7GPT-6 Astra, GPT-6 Sol, GPT-6 Luna
Elección de modeloAnthropic, Google, Meta, xAI; OpenAI hasta el 12/11Solo OpenAI
Contexto máximoOpus 5.5: 1M; Grok 4.7: 500KGPT-6 Astra y Sol: 1,05M
Precio individualHobby gratis, Pro 20 $, Pro+ 60 $, Ultra 200 $Free, Go 8 $, Plus 20 $, Pro desde 100 $
Precio para equiposTeams 40 $, Premium 120 $Business 25 $, 20 $ anual
CertificacionesSOC 2, ISO 27001, ISO 42001, AIUC-1OpenAI: SOC 2, ISO 27001, ISO 42001

Prueba nuestra AI Gateway gratis hoy

¿Qué son Cursor y Codex en 2026?

Cursor y Codex son agentes de programación con IA que leen código, editan archivos y ejecutan comandos. Cursor es un editor derivado de VS Code con agentes integrados. Codex es el agente de OpenAI, incluido en ChatGPT y disponible donde trabajes.

Cursor: un editor nativo de IA, ahora parte de SpaceX

SpaceX compró Anysphere por 60.000 millones de dólares en acciones el 14 de agosto de 2026, y Cursor está en la división SpaceXAI, según Yahoo Finance. Composer 2.5 (mayo) se basa en Kimi K2.5, según el blog de Cursor. Su documentación presenta Grok 4.7, de xAI, como modelo frontera.

Codex: el agente de programación de OpenAI

Según su documentación, Codex funciona en la nube, la app de escritorio de ChatGPT, una CLI, una extensión para IDE, un SDK y una GitHub Action. GPT-6 Astra llegó el 3 de septiembre de 2026, y GPT-6 Sol y Luna el 22 de septiembre, según TechCrunch.

La ruptura entre OpenAI y Cursor

El 28 de agosto, OpenAI dijo no confiar en que SpaceX respete sus condiciones y fijó el cierre para el 12 de noviembre. Michael Truell, CEO de Cursor, dijo que esos modelos suponen un 5 % del tráfico, según DevOps.com. Según CIO (2026), ningún modelo tiene garantizada su permanencia en una plataforma.

Cursor da variedad sin OpenAI; Codex, lo último de OpenAI sin alternativas. Para el agente de Anthropic, lee nuestra comparativa Claude Code vs Cursor.

Benchmarks de Cursor vs Codex: qué muestran las clasificaciones

Ningún benchmark público enfrenta a Cursor y Codex con el mismo modelo. Terminal-Bench 4.0 incluye Codex pero no el agente de Cursor, y CursorBench solo corre en Cursor. Lee cada clasificación como la prueba de un agente con modelos concretos.

Resultados de Terminal-Bench 4.0

Terminal-Bench 4.0 (Harbor y Laude Institute) evalúa agentes en 66 tareas de terminal.

PuestoModeloAgentePuntuación
1GPT-6 AstraCodex58,2 %
2Claude Fable 5.1Claude Code57,9 %
6Grok 4.7Grok Build37,6 %
7GPT-5.6 SolCodex37,3 %

Fuente: clasificación de Terminal-Bench 4.0 (actualizada el 24 de septiembre de 2026).

Codex ganó 20,9 puntos de GPT-5.6 Sol a GPT-6 Astra: el modelo pesa tanto como el agente. OpenAI declara un 57,9 % en su página de Astra. Con un agente neutral, Vals AI da a Claude Opus 5.5 un 61,62 % (19,07 $ por tarea) y a GPT-6 Astra un 57,07 % (8,21 $).

Resultados de CursorBench 4.0

Cursor lanzó CursorBench 4.0 el 10 de septiembre de 2026. Clasifica 57 configuraciones de modelo dentro de su propio agente.

Modelo (esfuerzo)ProveedorCursorBench 4.0Coste por tarea
Claude Opus 5.5 (High)Anthropic56,0 %3,97 $
Grok 4.7 (Extra High)xAI46,3 %6,01 $
GPT-5.6 Sol (Max)OpenAI41,7 %8,23 $
GPT-5.6 Sol (High)OpenAI35,7 %2,85 $
Composer 2.5Cursor27,7 % (puesto 50 de 57)0,68 $

Fuente: Cursor, clasificación de CursorBench 4.0 (elaborada por Cursor, septiembre de 2026).

CursorBench no incluye modelos GPT-6, y las filas de OpenAI salen de Cursor el 12 de noviembre.

SWE-bench y DeepSWE

OpenAI abandonó SWE-bench Verified en febrero de 2026 al ver que al menos el 59,4 % de los problemas auditados tenían tests defectuosos, y recomienda SWE-bench Pro, según su análisis. En DeepSWE v1.1, de Datacurve, GPT-6 Astra logra un 74 % a 4,43 $ por tarea.

Cómo hemos comparado Cursor y Codex

Solo usamos fuentes públicas y fechadas: webs de fabricantes, documentación, clasificaciones, una encuesta y registros de CVE. Señalamos los benchmarks de fabricante. Los precios son de lista en EE. UU. Usa cada cifra como base para tu piloto.

Flujo de trabajo: IDE, CLI o agentes en la nube

Cursor encaja si quieres la IA dentro de un editor visual, con CLI y agentes en la nube. Codex encaja si delegas tareas desde la terminal, tu editor o la nube y luego revisas el resultado. Ambos ejecutan agentes en paralelo.

FunciónCursorCodex
EditoresCursor (basado en VS Code)VS Code, Cursor, Windsurf, JetBrains, Xcode
Agente de terminalCursor CLI: modos Agent, Plan y AskCodex CLI (0.158.0, 28 de septiembre)
Agentes en la nubeVM aisladas (web, Slack, GitHub)Entornos aislados en paralelo
Revisión de códigoBugbot, Security ReviewRevisión en GitHub, Codex Security

Fuentes: Cursor changelog; Cursor cloud agents; Codex IDE; Codex changelog.

Dónde gana Cursor: revisión línea a línea y cambio de modelo. En septiembre sumó Projects (coordinadores con subagentes), máquinas autoalojadas y el bot Security Review.

Dónde gana Codex: un mismo agente en muchas superficies, programable con SDK o GitHub Action. Según Zapier (2026), la configuración por defecto de Codex está "bloqueada", mientras que la de Cursor es "productiva".

Precios de Cursor vs Codex: planes, créditos y coste por tarea

Los dos cuestan 20 $ al mes en el plan individual, pero luego la facturación diverge. Cursor cobra el extra a tarifa de API; Codex comparte los límites de ChatGPT y cobra el extra en créditos. Para equipos, ChatGPT Business cuesta menos por puesto.

Planes de suscripción

NivelCursorCodex (planes de ChatGPT)
GratisHobby: peticiones de Agent limitadasFree y Go (8 $): GPT-6 Luna, uso limitado
IndividualPro: 20 $/mesPlus: 20 $/mes (5-45 mensajes de Astra en 5 h)
Uso intensivoPro+: 60 $; Ultra: 200 $Pro: desde 100 $ (5x o 20x Plus)
EquiposTeams: 40 $ por usuarioBusiness: 25 $ por usuario, 20 $ anual
EnterpriseA medidaA medida

Fuentes: precios de Cursor; precios de Codex (septiembre de 2026).

Precio por token de los modelos

Por 1M de tokens (entrada / salida)PrecioDisponible en
GPT-6 Astra10 $ / 50 $Codex
GPT-6 Sol2 $ / 10 $Codex
GPT-5.6 Sol4 $ / 20 $Codex; Cursor hasta el 12/11
Claude Opus 5.54 $ / 20 $Cursor
Grok 4.72 $ / 6 $Cursor
Composer 2.50,50 $ / 2,50 $Cursor

Fuentes: fichas de GPT-6 Astra y GPT-6 Sol de OpenAI; modelos de Cursor.

Coste por tarea

En CursorBench, Composer 2.5 cuesta 0,68 $ por tarea y GPT-5.6 Sol (High) 2,85 $. En Terminal-Bench, según Vals AI, GPT-6 Astra cuesta 8,21 $, menos de la mitad que Opus 5.5, con 4,55 puntos menos. Gartner (2026) prevé que en 2028 programar con IA costará más que el salario medio de un desarrollador (nota de prensa). Nuestra guía de enrutamiento de modelos explica cómo limitarlo.

Controles empresariales y gobierno del dato

Ambos ofrecen SSO, SCIM y auditoría en sus planes altos. Codex añade una configuración gestionada que fija sandbox y aprobaciones en cada equipo, y Cursor, control de acceso a repositorios, modelos y MCP, y ejecución autoalojada.

ControlCursorCodex
SSOTeams y Enterprise (SAML/OIDC)Business y Enterprise (SAML SSO, MFA)
SCIM, RBAC, auditoríaSCIM, auditoría y cuentas de servicio (Enterprise)SCIM, RBAC, Compliance API y auditoría (Enterprise)
Política del agenteRepositorios, modelos, MCP; auto-run y redrequirements.toml: aprobaciones, sandbox, MCP, búsqueda web
Entrenamiento y retenciónPrivacy Mode por defecto en Enterprise; retención cero en casi todosSin entrenamiento con datos de empresa; retención configurable

Fuentes: Cursor security; Cursor privacy; Codex admin; Codex managed configuration; OpenAI security.

Ojo: con Claude Fable 5.1 y Fable 5 en Cursor, Anthropic guarda entradas y salidas. En Cursor, evalúa la matriz SpaceX y la salida de OpenAI; en Codex, la dependencia de un solo proveedor.

Seguridad y gobernanza: cómo usar agentes de programación con seguridad

Ambas han corregido fallos críticos. El punto débil común: los agentes leen repositorios, configuraciones, servidores MCP y webs no fiables, y actúan con los permisos del desarrollador. Es prompt injection, el riesgo LLM01 de OWASP.

Según el NIST (2026), una competición de CAISI con Gray Swan lanzó más de 250.000 ataques contra 13 modelos frontera, y todos cayeron al menos una vez.

FechaHerramientaProblemaGravedadEstado
Ago 2025Codex CLICVE-2025-61260: .codex/config.toml ejecutaba comandos MCP sin aprobaciónCVSS 9,8Corregido en 0.23.0
Feb 2026Codex en la nubeInyección por nombre de rama que exponía tokens de GitHubSin CVEParcheado (5 feb)
Feb 2026CursorCVE-2026-26268: git hook oculto ejecutado por el agenteAltaCorregido
Jul 2026CursorDuneSlide (CVE-2026-50548, CVE-2026-50549): escape de sandbox sin clicCVSS 9,8Corregido en Cursor 3.0
Sep 2026Codex CLI y escritorioCVE-2026-19591: el análisis de PowerShell evita la aprobaciónCVSS 8,8Parcheado

Fuentes: OpenCVE; The Hacker News; Novee; The Hacker News; SentinelOne.

Los sandbox por defecto son distintos

Codex ejecuta comandos locales en un sandbox workspace-write sin red, según su documentación de seguridad. OpenAI avisa de que, con acceso web, la prompt injection puede hacerle seguir instrucciones no fiables. Los agentes en la nube de Cursor usan VM aisladas con dominios de salida limitados.

Riesgos agénticos de OWASP en ambas herramientas

El OWASP Top 10 for Agentic Applications clasifica estos incidentes:

  • ASI01 Agent Goal Hijack: instrucciones ocultas en repositorios y webs (ver nuestra guía de indirect prompt injection).
  • ASI04 Agentic Supply Chain: configuraciones MCP envenenadas, como la CVE-2025-61260 (ver MCP Security 101).
  • ASI05 Unexpected Code Execution: git hooks y escapes de sandbox, como DuneSlide.

Según Veracode (2026), el código también requiere revisión: su informe halló un 56 % de aprobado en seguridad en más de 100 modelos. Sobre el modelo, lee el análisis de GPT-6 Astra para CISO.

Cómo protege NeuralTrust Cursor y Codex

NeuralTrust añade una capa de seguridad en ejecución para Cursor, Codex o ambos:

¿Cuál elegir? Cursor o Codex

Elige Cursor si quieres un editor visual y modelos de varios proveedores. Elige Codex si tu equipo delega trabajo desde la terminal o la nube, o si usas OpenAI como estándar. También puedes combinarlos, ya que la extensión de Codex funciona en Cursor.

Si eres...EligePor qué
Desarrollador que quiere diffs visualesCursorEditor con agentes integrados
Equipo que quiere varios proveedoresCursorClaude, Gemini, Grok, Composer, Meta
Ingeniero que delega tareas de terminalCodexGPT-6 Astra lidera Terminal-Bench 4.0
Equipo de plataforma con políticas localesCodexrequirements.toml fija sandbox y MCP
CISO que aprueba agentes a escalaCualquiera, tras un gatewayUna política y una auditoría por llamada

Conclusión

Elegir entre Cursor vs Codex en 2026 es elegir entre amplitud y profundidad de modelos. Cursor ofrece un gran editor y varios proveedores, pero pierde OpenAI el 12 de noviembre y ahora es de SpaceX. Codex ofrece los últimos modelos de OpenAI, líderes en Terminal-Bench 4.0, y valores por defecto más estrictos. Elijas cuál elijas, controla lo que ejecuta el agente: ambas han corregido fallos críticos este año.

Protege Cursor y Codex en producción con NeuralTrust

Ejecuta Cursor, Codex o ambos tras una capa de políticas, con protección en tiempo real de cada prompt, llamada y conexión MCP.

Prueba nuestra AI Gateway gratis hoy

Comparativas relacionadas

Preguntas frecuentes sobre Cursor vs Codex

1. ¿Es mejor Cursor o Codex?

Depende de cómo trabajes. Cursor es mejor si quieres un editor visual y varios proveedores, como Claude Opus 5.5, líder de CursorBench 4.0. Codex es mejor para delegar tareas de terminal y nube: con él, GPT-6 Astra lidera Terminal-Bench 4.0 con un 58,2 %.

2. ¿Seguirá Cursor ofreciendo modelos de OpenAI después del 12 de noviembre de 2026?

No, según los anuncios actuales. OpenAI comunicó el 28 de agosto de 2026 que cerrará su contrato con Cursor el 12 de noviembre, por sus dudas sobre SpaceX. Cursor dice que esos modelos suponen un 5 % de su tráfico. Si usas GPT en Cursor, prueba alternativas.

3. ¿Puedo usar Codex dentro de Cursor?

OpenAI sigue listando Cursor como editor compatible con la extensión de Codex, y Codex CLI funciona en cualquier terminal. No ha aclarado si el corte del 12 de noviembre afecta a la extensión. Con dos agentes, un gateway común mantiene una sola política.

4. ¿Qué es más barato, Cursor o Codex?

Para equipos, Codex es más barato por puesto: ChatGPT Business cuesta 25 $ por usuario al mes (20 $ en pago anual), frente a 40 $ de Cursor Teams. El plan individual cuesta 20 $ en ambos. El coste real depende del uso: Cursor cobra el extra a tarifa de API y Codex en créditos.

5. ¿Es Codex gratis?

Sí, con límites. OpenAI incluye Codex en el plan Free con GPT-6 Luna en la app de escritorio, y en Go por 8 $ al mes. Plus, por 20 $, añade GPT-6 Sol y Astra. Cursor ofrece el plan gratuito Hobby, con límites.

6. ¿Qué es más seguro para una empresa, Cursor o Codex?

Ninguno es seguro por defecto. Cursor corrigió DuneSlide (CVSS 9,8), y Codex la CVE-2025-61260 (CVSS 9,8) y la CVE-2026-19591 (CVSS 8,8). Codex trae valores locales más estrictos; Cursor tiene AIUC-1 y ejecución autoalojada. Añade mínimo privilegio, aprobaciones y monitorización a ambos.

Sobre el autor

Roger Howroyd es Head of Global SEO and AI en NeuralTrust, donde lidera la estrategia de búsqueda de la compañía en SEO, AEO, GEO y optimización para LLM. Está especializado en búsqueda impulsada por IA, estrategia de contenidos y SEM. Conecta con él en LinkedIn.

NeuralTrust es la plataforma líder para proteger y escalar agentes de IA. Nombrada Pioneer en el Gartner Emerging Market Quadrant for AI Application Security 2026, reconocida en cuatro informes Gartner Hype Cycle en 2026 e incluida en la Gartner Market Guide for Guardian Agents 2026, la Gartner Market Guide for AI Gateways 2025 y el KuppingerCole Leadership Compass for Generative AI Defense 2025. Con sede en Barcelona y oficinas en Londres y Nueva York. Certificada ISO 27001.

Fuentes

  1. OpenAI: Decision on Cursor (agosto de 2026)
  2. DevOps.com: OpenAI cuts Cursor access (agosto de 2026)
  3. CIO: Cursor loses OpenAI models (agosto de 2026)
  4. Yahoo Finance: SpaceX-Cursor deal (agosto de 2026)
  5. Cursor: Composer 2.5 (mayo de 2026)
  6. Cursor: Models (septiembre de 2026)
  7. Cursor: CursorBench 4.0 (septiembre de 2026)
  8. Cursor: Changelog (septiembre de 2026)
  9. Cursor: Cloud agents (septiembre de 2026)
  10. Cursor: Pricing (septiembre de 2026)

Suscríbete a nuestra newsletter

Compartir

Únete a los líderes que aseguran el ecosistema de agentes

Solicita una demo