A finales de agosto de 2026, elegir un entorno de desarrollo con inteligencia artificial ya no es decidir «qué autocompletado se siente más listo». Es decidir dónde vive el agente, qué modelos puede usar, quién aprueba un cambio y cómo se paga cuando la sesión no dura tres minutos, sino una tarde. Cursor se presenta como un agente de código para software ambicioso. Anthropic vende Claude Code en la terminal, el IDE, el escritorio y la web. OpenAI ofrece Codex en ChatGPT, el editor y la CLI. Cognition rebautizó Windsurf como Devin Desktop y lo coloca como centro de mando de flotas de agentes.
Este texto no declara un ganador. Separa lo que cada fabricante afirma en sus páginas oficiales de lo que un equipo puede concluir con una prueba propia. Si su pregunta de fondo es qué modelo usar detrás del editor, ya publicamos un análisis de
—precio, seguridad y un plan de treinta días—. Aquí el objeto es otro: la superficie de trabajo. El modelo importa. El arnés —dónde corre, con qué permisos y con qué freno humano— decide si esa inteligencia llega a producción o se queda en una demostración cara.
La documentación de Cursor lo define como «un agente de código para construir software ambicioso»: entender un repositorio, planear y construir funcionalidades, corregir fallos, revisar cambios y conectarse a las herramientas que el equipo ya usa. El Agent combina instrucciones, herramientas y un modelo: busca en el código y en la web, edita archivos, ejecuta comandos, controla un navegador y puede generar imágenes. No hay, según esa página, un tope de llamadas a herramientas por tarea. Los checkpoints guardan instantáneas locales —distintas de Git— para revertir un desvío del agente.
En la página de inicio, Cursor habla de agentes en la nube que construyen, prueban y demuestran funcionalidades, y de agentes «siempre activos» por horario o disparador. El selector de modelos que muestra incluye, entre otros, Grok 4.6, GPT-5.6 Sol, Fable 5, Opus 5, Gemini 3.1 Pro y Composer 2.5. Eso es catálogo de producto, no una tabla de rendimiento independiente. Privacy Mode, si el administrador o el usuario lo activan, incluye la garantía de Cursor de que ni ellos ni sus proveedores de modelos entrenan con el código.

Anthropic describe Claude Code como un agente que lee el repositorio, edita archivos, ejecuta comandos e integra las herramientas de desarrollo. Está en la terminal, en extensiones de IDE, en una app de escritorio y en el navegador. El FAQ oficial insiste en un rasgo de arquitectura: corre en local, habla directo con las APIs del modelo, no exige un servidor propio ni un índice remoto de código, y pide permiso antes de modificar archivos o lanzar comandos.
La misma página de producto enumera lo que el fabricante quiere que haga: mapear un codebase en segundos, convertir issues en pull requests, editar varios archivos con contexto de dependencias, y trabajar desde VS Code —también en Cursor y Devin Desktop—, JetBrains, Slack, GitHub, la web y el móvil. En la documentación, CLAUDE.md fija normas del proyecto; hay skills, hooks, MCP, subagentes en paralelo, Routines que corren en la nube aunque el ordenador esté apagado, y computer use. Es el arnés más explícitamente «Unix»: se puede encadenar con tuberías, CI y un CLAUDE.md versionado.
OpenAI presenta Codex como el mismo agente de ingeniería de software en ChatGPT, en la extensión de IDE y en la CLI, unidos por la cuenta de ChatGPT. Afirma que completa tareas de extremo a extremo, que admite flujos multiagente con worktrees y entornos en la nube, y que las Skills enseñan al equipo. También afirma que está «hecho para trabajo en segundo plano siempre activo»: triage, alertas, CI/CD. En el anuncio de ChatGPT Work, OpenAI cifra en más de cinco millones los usuarios semanales de Codex y en más de un millón quienes lo usan fuera del desarrollo; dice además que Chat, Work y Codex están en la app de escritorio en todos los planes, incluido el gratuito. Son cifras del fabricante.
Ese «siempre activo» de marketing no es el Persistent mode que Wired encontró en el repositorio de la CLI y que OpenAI, según La Vanguardia, está probando sin lanzamiento inmediato. Si su equipo evalúa Codex hoy, evalúe el producto publicado. El prototipo persistente es otra conversación: la cubrimos en la nota hermana sobre ese modo.
En la página oficial, Cognition es directa: «Devin Desktop is the new name for Windsurf». El IDE sigue ahí —resaltado de sintaxis, autocompletado, depuración—, pero el centro de la interfaz es el Agent Command Center: Spaces, vista Kanban y gestión de varios agentes. El plan, el precio, las extensiones y los ajustes de Windsurf se migran; el fabricante dice que no cambian. Sigue existiendo Windsurf para JetBrains.
La promesa distintiva es la apertura a otros agentes. Devin Desktop muestra Devin en la nube y en local, Codex, Claude Agent, OpenCode y Cascade, unidos por el Agent Client Protocol (ACP). Supercomplete se vende como un tabulador que predice el siguiente pensamiento, no sólo la siguiente edición. Cognition afirma «más de un millón» de desarrolladores y «más de 4.000» clientes empresariales. Trátelo como reclamo comercial, no como auditoría.
El mercado ya no es «un IDE contra otro». Es un editor, una terminal y una nube que, cada vez más, se prestan los mismos agentes.
Los blogs secundarios no coinciden siempre en el detalle de las bolsas de uso. Aquí sólo repetimos lo que estaba en las páginas de los fabricantes al consultarlas el 28 de agosto de 2026. Los impuestos van aparte, salvo donde el vendedor diga lo contrario. Los planes cambian: verifique el enlace antes de firmar.
La métrica útil no es el renglón de 20 dólares. Un agente que relee el repo, lanza pruebas y se equivoca dos veces puede vaciar una bolsa semanal o disparar el uso bajo demanda. Compare costo por tarea terminada —con revisión humana— no costo por asiento.
Si dos blogs discrepan en el precio exacto de una bolsa de tokens, omita esa cifra y abra la página del fabricante el día que vaya a comprar.
Hay tres ejes que importan más que el nombre del modelo del mes.
Superficie. Cursor y Devin Desktop son IDEs: usted vive en el editor, con pestañas, LSP y un agente al lado o en un tablero. Claude Code y Codex CLI son primero agentes de terminal que después se meten en el IDE. Claude Code, de hecho, declara extensión nativa para VS Code «(+ Cursor, Devin Desktop)». Un equipo puede pagar Cursor o Devin Desktop y, encima, correr Claude Code o Codex dentro. Eso no es un empate: es una factura doble si nadie lo diseña.
Modelo y encierro. Cursor y Devin Desktop se venden como multi-modelo y, en el caso de Devin, multi-agente vía ACP. Claude Code está atado de origen a Claude —con proveedores terceros en CLI, VS Code y JetBrains, según la documentación— y a una bolsa compartida con el chat. Codex está atado al ecosistema ChatGPT y a los modelos de OpenAI. Si su riesgo es depender de un solo laboratorio, un IDE abierto a varios agentes reduce ese riesgo. Si su riesgo es la inconsistencia de estilo entre modelos, un arnés de un solo fabricante puede ser más fácil de gobernar.
Permiso y persistencia. Claude Code documenta el permiso explícito antes de editar o ejecutar. Cursor documenta checkpoints locales y un /goal de larga duración, todavía en despliegue. Codex documenta aprobaciones, sandbox y un Codex Security aparte. Devin Desktop vende el cierre del portátil y el traspaso a la nube. Ninguno de esos textos sustituye su propia política: quién puede dejar un agente escribiendo cuando la oficina está vacía.
Use estas preguntas con casos reales, no con una demo del vendedor.
Semana 1: elija 15 a 20 tareas reales —un bug, un test flaky, un refactor chico, una revisión de PR—. Ejecute dos herramientas, no cuatro. No cambie de modelo y de superficie al mismo tiempo. Semana 2: conecte el repositorio en modo lectura o en una rama desechable. Registre tiempo hasta un diff revisable, tokens o porcentaje de bolsa gastado, e intervenciones humanas. Semana 3: habilite una sola acción reversible (abrir un PR, no desplegar). Si el agente no puede explicar qué tocó, citar archivos y detenerse, no está listo. Escale sólo si mejora una métrica de negocio sin degradar calidad ni seguridad.
La adopción responsable avanza de un entorno aislado a producción mediante evidencia, permisos progresivos y supervisión humana.

La pregunta útil de 2026 no es «¿cuál es el mejor IDE con IA?». Es «¿dónde quiero que viva el agente, y qué le dejo hacer cuando yo no estoy?». Cursor y Devin Desktop compiten por ser ese lugar dentro del editor. Claude Code y Codex compiten por ser el agente que usted lleva de la terminal al chat y de vuelta. Los cuatro se están metiendo en el territorio de los otros: Claude Code dentro de Cursor y Devin Desktop, Codex dentro de Devin Desktop, agentes en la nube en casi todas las fichas.
Mi recomendación es concreta. No compre dos asientos «por si acaso» sin una prueba de tres semanas. Elija la superficie donde su equipo ya pasa el día. Fije un proceso que hoy consuma al menos cinco horas por semana. Mida finalización correcta, retrabajo y costo. Conserve intervención humana cuando el error cueste dinero, datos o reputación. Y no adopte un producto por una cifra de usuarios del fabricante ni por un modo persistente que todavía no se ha lanzado.
La promesa de estos IDEs es terminar más código con menos seguimiento mecánico. El trabajo de la empresa es demostrar que ese código era el correcto y que alguien, en todo momento, puede apagar al agente.
Nota editorial: las cifras de usuarios, tiempos de desarrollo y «siempre activo» citadas proceden de las páginas de los fabricantes. Deben validarse con una prueba en su repositorio antes de decidir una compra. Donde un blog secundario contradice la tarifa oficial, prevalece la página del fabricante; si la oficial no publica un número, esta nota no lo inventa.
Enviando comentario…
Si tu proyecto requiere una solución más enfocada, entra directo a la landing ideal para tu negocio y envíanos tu información en el formulario correspondiente.
0 Comentarios