Mejores agentes de código en 2026: comparativa de 11 herramientas y cuál usar en cada caso
Un agente de código no es un autocompletador: es un programa que lee tu repositorio, edita ficheros, ejecuta comandos y hace commits por su cuenta. En agosto de 2026 los tres que más se usan son Claude Code, OpenAI Codex y Cursor. Si buscas plan gratuito real, Codex es el único de los tres que lo tiene. Si buscas código abierto, ninguno de los tres lo es. Abajo tienes los once comparados con precio verificado, licencia comprobada en el repositorio y un veredicto por herramienta.
Última verificación: 13 de agosto de 2026. Todos los precios y licencias de esta página se comprobaron entre el 11 y el 13 de agosto en la web oficial de cada producto. Este sector cambia cada semana: si ves una fecha de verificación de hace más de dos meses, desconfía de la tabla, de la nuestra también.
¿Qué es exactamente un agente de código?
Es un programa que trabaja sobre tu proyecto con cierta autonomía: lee los ficheros, decide qué cambiar, escribe el código, ejecuta los tests y, si algo falla, lo vuelve a intentar. La diferencia con un asistente clásico está en el verbo. Un asistente sugiere; un agente ejecuta.
Esa diferencia tiene una consecuencia que conviene entender antes de instalar nada: un agente de código corre con tus permisos. Puede borrar ficheros, hacer push, gastar tokens y romper cosas. Todos los que verás aquí tienen algún mecanismo de aprobación, pero ninguno te exime de revisar lo que hace.
Y hay una segunda distinción que casi ningún comparativo hace, y que explica por qué esta lista mezcla cosas que parecen incomparables: no todas estas herramientas son agentes. Algunas son el agente, otras son la casa donde vive el agente. Vamos por categorías.
¿Qué tipos de agentes de código hay?
| Categoría | Qué hace | Herramientas |
|---|---|---|
| Agente de terminal (CLI) | Es el agente. Corre en tu terminal sobre tu repo | Claude Code, OpenAI Codex, Gemini CLI |
| Agente en el IDE | El agente vive dentro de un editor gráfico | Cursor |
| Orquestador | No programa: gestiona sesiones de los agentes de arriba | Xirp |
| Workspace de agentes | Espacio de trabajo compartido donde los agentes son un miembro más | Buzz, Cloudflare OS |
| Agente personal | Agente de propósito general que además puede tocar código | OpenClaw |
| Agente de trabajo | No programa: usa tus aplicaciones por ti desde su propio ordenador | Grok Bot |
| SDK de navegador | No es un agente: es la librería con la que escribes uno que navegue | Stagehand |
Meterlas todas en una lista plana de "mejores herramientas de IA" es el error que comete casi todo el mundo, y es la razón por la que tanta comparativa recomienda cosas que no compiten entre sí. Un orquestador no sustituye a un agente: lo necesita.
Tabla comparativa: 11 agentes de código en agosto de 2026
| Herramienta | Tipo | Licencia | Plan gratuito | Precio de entrada | Modelos | Plataformas |
|---|---|---|---|---|---|---|
| Claude Code | CLI + IDE + escritorio | Propietaria | No | 20 $/mes (Pro) | Solo Anthropic | macOS, Linux, Windows |
| OpenAI Codex | CLI + IDE + nube | CLI Apache-2.0, servicio propietario | Sí | 8 €/mes (Go) · Plus 23 € | Solo OpenAI | macOS, Linux, Windows |
| Cursor | IDE | Propietaria | Sí (limitado) | 20 $/mes (Pro) | Multi-proveedor | macOS, Linux, Windows, web, iPad |
| Gemini CLI | CLI | Apache-2.0 | Ya no | Licencia Code Assist o API | Solo Gemini | macOS, Linux, Windows |
| Antigravity CLI | CLI | Propietaria | Según plan Google | Incluido en planes Google AI | Multi-modelo | macOS, Linux, Windows |
| Xirp | Orquestador | Propietaria | Sí (beta) | Sin precio público | Los que orqueste | Solo macOS |
| Buzz | Workspace | Open source | Sí | Autoalojado | Los que conectes | Multiplataforma |
| Cloudflare OS | Workspace | Apache-2.0 | Sí | Autoalojado | Los que conectes | Multiplataforma |
| OpenClaw | Agente personal | MIT | Sí | Tus tokens + hosting | 50+ proveedores | macOS, Linux, Windows |
| Grok Bot | Agente de trabajo | Propietaria | No | 200 $/mes (Cursor Ultra) | Sin publicar | macOS, Windows, iPhone |
| Stagehand | SDK de navegador | MIT | Sí (el SDK) | Gratis + infra + tokens | 5 proveedores + callback | TS, Python, Go |
Dos lecturas rápidas de esa tabla, porque son las que más gente se salta:
El plan gratuito casi no existe. De los tres agentes de código más usados, solo Codex tiene tramo gratis de verdad. Claude Code no lo ha tenido nunca. Y Gemini CLI lo tuvo y lo perdió: Google cortó el acceso gratuito el 18 de junio de 2026.
Código abierto no significa gratis, y gratis no significa abierto. Gemini CLI es Apache-2.0 y hoy no puedes usarlo sin pagar. OpenClaw es MIT y gratis, pero la factura de tokens la pagas tú. Claude Code tiene un repositorio público con más de 141.000 estrellas y no es open source: ese repositorio no contiene el código del CLI, solo el changelog, ejemplos y el gestor de incidencias.
Los agentes de terminal
Son los que más lejos llegan sin supervisión, y donde está la batalla real de 2026.
Claude Code
Agente de Anthropic que nació como CLI y hoy es un motor único con muchas superficies: terminal, extensiones de VS Code y JetBrains, app de escritorio, web, móvil, Slack y CI.
Precio. No hay tramo gratuito. Pro 20 $/mes (17 $/mes pagando anual), Max 5x 100 $/mes, Max 20x 200 $/mes, Team desde 20 $/asiento. Alternativa por consumo con clave de API.
Lo que no se cuenta. Los límites no son por tokens sino por ventanas de sesión de 5 horas más un tope semanal, y Anthropic no publica las cifras. Además el modelo por defecto cambia según lo que pagues: Opus 5 en Max, Sonnet 5 en Pro. El mismo producto no rinde igual en un plan que en otro.
Solo ejecuta modelos Claude. Los "terceros" que aparecen en su documentación (Amazon Bedrock, Microsoft Foundry, Google Cloud) son rutas de facturación, no otros modelos.
Veredicto: lo mejor si ya pagas Pro o Max y trabajas en terminal sobre repositorios grandes. Evítalo si necesitas licencia auditable, independencia de proveedor o presupuesto predecible.
OpenAI Codex
El agente actual de OpenAI, que no tiene nada que ver con el modelo Codex de 2021. Se distribuye como CLI en Rust, extensión de IDE, app de escritorio y un entorno en la nube que abre pull requests.
Precio en España, en euros. Gratis 0 €, Go 8 €, Plus 23 €, Pro desde 103 €, Business 21 €/usuario/mes en anual (mínimo 2 usuarios).
La licencia tiene truco, y es un truco honesto. El repositorio openai/codex es Apache-2.0 de verdad, verificado en su fichero LICENSE. Pero eso cubre solo el cliente: los modelos y el servicio son propietarios y de pago. Sin suscripción o clave de API, el binario abierto no hace nada.
Aviso con fecha. El 31 de agosto de 2026 GPT-5.4 y GPT-5.4 mini dejan de estar disponibles en Codex para usuarios autenticados con ChatGPT. Si lees una comparativa que aún los recomienda, está caducada.
Veredicto: lo mejor si ya pagas ChatGPT y quieres el mismo agente en terminal, IDE y nube, con la única entrada gratuita real de los tres grandes. Evítalo si esperabas un agente agnóstico: su CLI solo habla la Responses API, así que los endpoints compatibles con Chat Completions dejaron de funcionar.
Gemini CLI (y su sustituto, Antigravity CLI)
Aquí hay una noticia que la mayoría de comparativas todavía no ha incorporado, y que invalida sus recomendaciones.
Gemini CLI existe, es Apache-2.0 y su código sigue siendo libre y compilable. Pero desde el 18 de junio de 2026 Google dejó de servir peticiones al tramo gratuito, a Google AI Pro y a Google AI Ultra. El corte se ejecutó sin periodo de gracia y rompió scripts, GitHub Actions y pipelines de CI. Hoy solo funciona con licencia Code Assist Standard o Enterprise, o con clave de API de pago.
Su sustituto oficial es Antigravity CLI, que se invoca como agy. Es multi-modelo (Gemini 3.6 Flash, 3.5 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.6 y GPT-OSS-120b) pero no es open source: es un binario cerrado.
Veredicto: el movimiento de Google cambió un CLI abierto y gratuito por uno cerrado y de pago. Si tienes Code Assist Enterprise, Gemini CLI sigue siendo una buena opción auditable. Si venías del tramo gratis, tu opción hoy es Codex.
El agente dentro del editor
Cursor
Editor propietario basado en VS Code con agentes integrados. Desde la versión 3.0 el producto gira alrededor de ejecutar varios agentes en paralelo (local, worktrees, nube, SSH), más que alrededor del editor clásico.
Precio. Hobby 0 $ con "peticiones de agente limitadas" (Anysphere no publica las cifras concretas del gratuito), Pro 20 $/mes con 20 $ de consumo de modelos de terceros incluidos, Pro+ 60 $ con 70 $ incluidos, Ultra 200 $ con 400 $ incluidos.
Ese modelo de "incluye X $ de consumo" es la diferencia práctica más importante frente a Claude Code: aquí sabes exactamente cuánto uso llevas, pero la factura es variable en cuanto lo superas.
Es el más agnóstico de los grandes: modelos propios (Composer 2.5, Grok 4.5) más Anthropic, OpenAI, Google, Moonshot y Z.ai.
El dato que tienes que saber antes de casarte con él: medios especializados reportan que el 16 de junio de 2026 SpaceX acordó la adquisición de Anysphere por 60.000 millones de dólares en acciones, con cierre previsto para el tercer trimestre de 2026. Sigue sin haber un comunicado oficial conjunto que lo confirme como cerrado. Grok 4.5, uno de sus dos modelos propios, ya está entrenado conjuntamente con SpaceXAI. No es un juicio de valor: es un cambio de propiedad que puede afectar a precios y a modelos disponibles, y estás eligiendo herramienta de trabajo.
Veredicto: lo mejor si quieres el agente más pulido dentro de un IDE que ya sabes usar. Evítalo si necesitas código auditable, si tu presupuesto no tolera factura variable, o si te incomoda que tu editor pase a ser filial de SpaceX este trimestre.
Orquestadores y workspaces
Esta categoría existe desde hace pocos meses y resuelve un problema que solo tienes cuando ya usas agentes en serio: cuando tienes cuatro sesiones abiertas y no sabes qué está tocando cada una.
Xirp
App de escritorio de Spotify, en beta pública desde el 10 de agosto de 2026, que gestiona sesiones de Claude Code, Codex y Gemini CLI desde una sola interfaz. Cada sesión corre en su propio git worktree, así que varios agentes trabajan en paralelo sobre el mismo repositorio sin pisarse. La persistencia va por tmux.
Solo macOS, sin precio público y no es open source, pese a lo que muchos asumieron por el precedente de Backstage: su propia documentación lo define como software propietario. No orquesta modelos, orquesta CLIs: tienes que tenerlos ya instalados y autenticados.
Veredicto: interesante si estás en macOS y ya tienes el problema de las cuatro terminales. Prematuro para todo lo demás: es beta, es de un mes, y la única forma de saber si sobrevive es esperar.
Buzz
El workspace de Jack Dorsey donde los agentes de IA son miembros del equipo, no herramientas: tienen su propio canal, su propio historial y participan en la conversación. Es open source y construye sobre protocolos abiertos, que es exactamente la apuesta contraria a la de Xirp.
Lo analizamos entero en qué es Buzz y cómo funciona.
Cloudflare OS
Entorno de trabajo para agentes bajo Apache 2.0, lanzado el 5 de agosto de 2026, con "gadgets" en sandbox y "gatekeepers" para aprobar acciones. Es la apuesta más ambiciosa de las tres y la más difícil de adoptar hoy.
Aviso para no confundirlo con otro lanzamiento de la misma semana: Cloudflare presentó también Kitesurf (6 de agosto de 2026), y no es un orquestador de agentes. Es un navegador headless escrito en Rust y WebAssembly, pensado para que los agentes naveguen sin Chromium debajo. Categoría distinta y problema distinto.
El agente personal
OpenClaw
No es un agente de código, pero acaba usándose como tal, así que merece estar aquí. Es un runtime autoalojado que enruta mensajes entre tus apps de chat (WhatsApp, Telegram, Signal, Slack, Discord) y el modelo que tú elijas, con acceso a shell, ficheros y navegador.
Licencia MIT verificada en el fichero LICENSE, sin edición enterprise ni núcleo cerrado. Es el más agnóstico de toda esta lista: más de 50 proveedores soportados, incluidos modelos locales con Ollama, LM Studio o vLLM.
Precio. El software es gratis y no tiene tramos. Pagas los tokens del proveedor que conectes y el hosting si no lo corres en tu portátil (un VPS típico va de 3 a 50 $/mes).
Y una advertencia que hay que dar. Autoalojar un agente con acceso a tu shell y a tu WhatsApp tiene una superficie de ataque real: en julio de 2026 se reportó una vulnerabilidad de ejecución remota de código a un clic. Si no vas a leer logs ni auditar las skills de terceros que instales, esta no es tu herramienta.
Veredicto: lo mejor si sabes administrar un servidor y quieres un agente con tus claves y tus datos. Evítalo si "autoalojado" te suena a palabra de marketing y no a responsabilidad.
Grok Bot
Tampoco es un agente de código, y por eso está el último: es un agente de trabajo. Lo anunció SpaceXAI (antes xAI) el 11 de agosto de 2026 y su propuesta es distinta a todo lo anterior: inicia sesión en tus aplicaciones desde un ordenador propio en la nube y te devuelve el trabajo hecho.
Lo incluimos aquí porque marca la frontera de la categoría: donde los de arriba escriben código, este usa aplicaciones. Y porque plantea el problema que el resto todavía no tiene: qué pasa con tus credenciales.
Precio. No se vende suelto: va incluido en Cursor Ultra (200 $/mes) y Cursor Premium Teams (120 $/asiento/mes), con consumo por tokens por encima. Sin plan gratuito permanente.
El dato que hay que saber. Su documentación oficial dice que todos tus bots comparten un mismo ordenador en la nube, con los ficheros, las sesiones de navegador y las credenciales disponibles para todos, y advierte de forma explícita: "Do not use separate Bots as a security boundary".
Veredicto: el planteamiento más ambicioso de la lista y también el que más te pide a cambio. Antes de conectarlo a nada corporativo, lee el análisis completo de Grok Bot, con lo que dice su letra pequeña sobre tus credenciales.
Stagehand
Y este cierra la lista porque es el único que no es una herramienta que uses, sino una librería con la que construyes. Es el SDK de Browserbase para que un programa controle un navegador Chrome con instrucciones en lenguaje natural en vez de selectores CSS.
Su versión 4, del 10 de agosto de 2026, es una reescritura: deja de depender de Playwright y mete su motor dentro del navegador como extensión de Chrome.
Precio. El SDK es MIT y gratis, y corre en local contra tu propio Chrome. Pagas aparte la infraestructura de navegador de Browserbase (Developer 20 $/mes, Startup 99 $/mes) y los tokens del modelo.
El dato que hay que saber. La versión que se anuncia como "el SDK para agentes de navegador" es la misma que elimina el método agent(). Su guía de migración lo dice sin rodeos: desaparece y nada lo sustituye uno a uno. El motivo es razonable (cada paso de aquel agente era una llamada de inferencia) pero conviene saberlo antes de migrar.
Veredicto: para tests, Playwright y gratis. Para páginas que cambian, iframes anidados o shadow DOM cerrado, Stagehand es objetivamente mejor. Análisis completo en qué es Stagehand.
¿Cuál elijo según mi caso?
| Tu situación | Qué usar | Por qué |
|---|---|---|
| Estás aprendiendo a programar | Codex (tramo gratis) o Cursor Hobby | Empieza donde no pagues, y ve más abajo: hay una forma correcta y una incorrecta de usarlos mientras aprendes |
| Ya pagas ChatGPT | Codex | Coste marginal cero y la misma herramienta en terminal, IDE y nube |
| Ya pagas Claude Pro o Max | Claude Code | Mismo argumento, y es el que más lejos llega sin supervisión |
| Vienes de VS Code y no quieres cambiar | Cursor | Importa extensiones, temas y atajos en un clic |
| Necesitas código auditable | OpenClaw, o Gemini CLI con licencia Code Assist | Son los únicos con licencia OSI real y verificada |
| No quieres depender de un proveedor | OpenClaw | 50+ proveedores, incluidos modelos locales |
| Tienes 4 sesiones abiertas y te pierdes | Xirp, si estás en macOS | Es exactamente el problema que resuelve |
| Presupuesto cero de verdad | Codex gratis u OpenClaw con modelos locales | El resto o no tiene tramo gratis o no publica sus límites |
¿Y si estoy aprendiendo a programar?
Esta pregunta no la responde ninguna de las comparativas que rankean hoy, y es la que más nos hacen. Va aparte porque la respuesta es distinta.
El riesgo real no es que el agente se equivoque: es que acierte. Cuando un agente resuelve el ejercicio por ti y funciona, el bucle de aprendizaje se rompe sin que te des cuenta. Sales con el proyecto hecho y sin haber aprendido a depurar, que es la habilidad que de verdad te van a pagar.
Tres reglas que funcionan y que puedes aplicar hoy:
- Escribe tú primero, pregunta después. Usa el agente para revisar tu código, no para escribirlo. La misma herramienta, invertido el orden, produce el efecto contrario.
- Prohíbete aceptar código que no sepas explicar. Si no puedes decir en voz alta qué hace cada línea, bórralo y hazlo tú. Es lento y es el atajo.
- Usa el agente para lo que ya dominas. Automatizar lo aburrido está bien cuando ya sabes hacerlo a mano. Automatizar lo que no sabes es hipotecar tu criterio.
Y una cosa que conviene decir sin adornos: saber usar un agente no es una habilidad que te vaya a diferenciar en 2027, porque lo va a saber todo el mundo. Lo que sí diferencia es entender qué hay debajo: arquitectura de agentes, orquestación multiagente, RAG, evaluación. Esa capa es la que trabaja el programa de Ingeniería de IA para desarrolladores de 4Geeks Academy, si ya sabes programar y quieres construir con esto en vez de solo usarlo.
Novedades {#novedades}
Registro de cambios del sector, con fuente y fecha. Lo actualizamos al cerrar cada mes.
- 10 de agosto de 2026: Browserbase publica Stagehand v4, reescritura del SDK de navegación para agentes: fuera Playwright como dependencia, motor dentro del navegador… y fuera el método
agent(). Análisis completo. - 11 de agosto de 2026: SpaceXAI lanza Grok Bot en beta temprana: un agente que inicia sesión en tus aplicaciones desde su propio ordenador en la nube. Se distribuye a través de Cursor, desde 200 $/mes. Su documentación admite que todos tus bots comparten esa máquina y sus sesiones. Análisis completo.
- 10 de agosto de 2026: Spotify lanza Xirp en beta pública. Orquestador de sesiones de Claude Code, Codex y Gemini CLI. Solo macOS y propietario, pese a lo que se dijo en su lanzamiento. Ficha completa arriba.
- 6 de agosto de 2026: Cloudflare presenta Kitesurf, navegador headless para agentes escrito en Rust y WebAssembly. En beta gratuita con límites por cuenta.
- 5 de agosto de 2026: Cloudflare lanza Cloudflare OS, workspace de agentes bajo Apache 2.0.
- 31 de julio de 2026: OpenAI anuncia la retirada de GPT-5.4 y GPT-5.4 mini de Codex para usuarios autenticados con ChatGPT, efectiva el 31 de agosto.
- 24 de julio de 2026: Claude Opus 5 pasa a ser el modelo por defecto de Claude Code en los planes Max, Team Premium y Enterprise.
- 18 de junio de 2026: Google corta el acceso gratuito a Gemini CLI sin periodo de gracia. Antigravity CLI queda como sustituto oficial.
- 16 de junio de 2026: medios especializados reportan la adquisición de Anysphere (Cursor) por parte de SpaceX, por 60.000 M$ en acciones, con cierre previsto en el tercer trimestre. Sigue sin haber confirmación oficial conjunta.
Cómo hemos hecho esta comparativa
Lo decimos porque casi ninguna de las comparativas que rankean hoy lo hace, y porque afecta a si nos puedes creer.
4Geeks no vende ninguna de estas herramientas ni tiene acuerdo comercial con ninguna. Somos una escuela: nuestro interés es que entiendas el sector, no que instales un producto concreto. Verás que varias de las comparativas mejor posicionadas se colocan a sí mismas en el primer puesto de su propio ranking.
Qué verificamos y cómo. Cada precio se comprobó en la página oficial de precios el 11 de agosto de 2026. Cada licencia se comprobó en el fichero LICENSE del repositorio o en los términos de servicio, no en lo que dice la portada del producto: así descubrimos que Claude Code no es open source pese a su repositorio de 141.000 estrellas, y que Xirp tampoco lo es.
Qué no hemos hecho. No hemos ejecutado un benchmark propio de calidad de código. Cuando decimos que un agente "llega más lejos" es criterio de uso, no una cifra medida. Y donde una empresa no publica sus límites (Anthropic con sus topes de sesión, Anysphere con su plan gratuito) lo decimos en vez de rellenarlo con una estimación.