Orquestadores de agentes de IA: cuál usar y para qué sirve cada uno
Si has estado pendiente de las herramientas de IA de los últimos meses, seguramente ya viste proyectos como cmux, Conductor o Herdr, que básicamente permiten administrar distintos agentes de IA desde una sola interfaz. Y no son los únicos: también están GPT Codex Desktop, Claude Code Desktop, e incluso editores de código que antes solo servían para escribir código y que ahora incluyen interfaces para manejar múltiples agentes.
La pregunta obvia es: ¿cuál de todas usar? ¿Cuál realmente vale la pena pagar? En este artículo voy a categorizarlas todas — aplicaciones de escritorio, herramientas de consola, administradores de agentes y editores de código — para que tengas un orden claro y sepas cuál te conviene según tu flujo de trabajo.
Primero: ¿cómo se llaman estas herramientas?
Todos estos programas compiten prácticamente en lo mismo, pero no existe un nombre estándar para la categoría. Vas a encontrarlos como agent managers (administradores de agentes), agent development environments (entornos de desarrollo de agentes) o agent orchestrators (orquestadores de agentes). Pueden ser aplicaciones de escritorio, aplicaciones web o entornos de consola, pero la idea es la misma: administrar distintos agentes desde una sola interfaz y, dependiendo de la herramienta, hacer que trabajen en conjunto.
Un detalle importante antes de empezar: aunque uno siempre quiere elegir un solo programa, en la práctica vas a terminar usando varios. En mi día a día llego a usar unas tres, y la razón es que no hacen exactamente lo mismo.
Aplicaciones de escritorio
GPT Codex Desktop
GPT Codex Desktop es la aplicación de ChatGPT pero para el escritorio, y no es lo mismo que usar ChatGPT en la web. La versión web está enfocada en usuarios genéricos: preguntas y respuestas. Codex Desktop hace más: genera código, crea scripts y puede reconfigurar programas dentro de tu computadora porque tiene acceso al sistema operativo.
Es una de las interfaces más populares, aunque con una advertencia: la versión de Windows falla bastante. Está claramente más cuidada para Mac. Soporta Mac y Windows, pero no está disponible para Linux todavía. Lo bueno es que puedes usar tu misma suscripción de ChatGPT, así que no hay costo adicional.
Claude Code Desktop
Claude Code Desktop es el competidor directo: un chat donde responde la IA, el navegador de archivos al lado y múltiples sesiones en el panel izquierdo. Anthropic tuvo su aplicación de escritorio desde hace tiempo, pero empezaron por el chat y luego integraron Claude Code; OpenAI hizo el camino inverso y se enfocó desde el inicio en ser un entorno de desarrollo, lo que le dio una interfaz más pulida. De hecho, OpenAI hasta hace poco ofrecía migración desde Claude Code, tratando de robarle usuarios a Anthropic.
¿Por qué no quedarse con uno solo?
Principalmente por la suscripción. Con Claude Code accedes a puros modelos de Anthropic — que en mi opinión son los mejores para código, actualmente con Opus 5 y Fable 5 como sus modelos frontier, los que salen primeros en casi todos los benchmarks. GPT tampoco se queda atrás con GPT 5.6, un modelo comparable a Opus 5, aunque el más avanzado a la fecha sigue siendo Fable 5.
El problema es que estas interfaces te encierran en un ecosistema: si pagas ChatGPT, solo usas Codex Desktop; si pagas Claude, solo usas su ecosistema. En mi caso pago ambas (y varias más) y las uso a diario, porque cada una tiene ventajas en tareas distintas. GPT me gusta como asistente de IA diario — leer correos, automatizar tareas puntuales, generar código de tareas muy específicas — porque es más barato y la suscripción es generosa. Pero para escribir código en serio, uso principalmente los modelos de Anthropic.
OpenCode Desktop
OpenCode es la alternativa para quienes quieren variedad de modelos. En lugar de estar ligado a GPT o Claude, por detrás usa modelos abiertos (open weight) como DeepSeek, Qwen, MiniMax o Kimi, que está muy popular justo ahora. Como esos modelos vienen de distintos laboratorios, OpenCode ofrece su propia suscripción llamada OpenCode Go, que te da acceso a una variedad enorme de modelos a menor precio.
Dos cosas que me gustan: primero, tienen una propuesta de diseño distinta — no es la misma UI que ofrecen todos. Segundo, es una interfaz abierta: puedes conectar cualquier proveedor, no solo su suscripción. Si pagas Kimi, conectas tu clave; si tienes suscripción de NVIDIA u otro proveedor, también.
Herramientas de consola (CLI)
Todas estas interfaces de escritorio tienen su equivalente en terminal: el comando codex, el comando claude y el comando opencode. Los tres ofrecen la misma experiencia, cada uno con sus propios modelos.
Aquí viene una pregunta muy común: si ya existen las aplicaciones de escritorio, ¿no es exactamente igual usar la terminal? En teoría no, y para generación de código las herramientas de consola suelen ser un poco mejores. Aclaro que no hay una métrica oficial — Anthropic no publica comparaciones entre Claude Code Desktop y Claude Code CLI — pero a partir de las filtraciones de hace unos meses, se sabe que el CLI está mucho más pensado para generación de código a nivel de desarrollo, mientras que la versión desktop apunta más a usuarios no técnicos, más al estilo vibe coding.
Harness engineering: por qué el mismo modelo responde distinto
En los últimos meses surgió el término harness engineering: aunque uses el mismo modelo, la herramienta desde donde lo llamas cambia el resultado. Puedes usar Claude Opus desde VS Code y desde Claude Code, y responde mejor en Claude Code — no solo porque es una herramienta de Anthropic, sino porque adaptaron el harness (la aplicación que ejecuta el modelo) específicamente para generar código y llamar ciertos comandos, mientras que VS Code está hecho para que funcionen múltiples modelos de forma genérica. Esto también responde la duda de "¿usar Claude Opus desde GitHub Copilot es lo mismo que Claude Code?": no, no lo es, aunque el modelo sea el mismo.
Otros agentes de terminal
Cada herramienta de consola suele estar ligada a un modelo:
- Kimi Code: solo modelos de Kimi.
- Amp: abierto a integrar varios modelos, pero ofrecen su propia suscripción con varios modelos bajo un solo pago.
- pi: un harness abierto donde puedes usar cualquier proveedor, similar en filosofía a OpenCode.
Y aquí llegamos al problema central: si pagas OpenCode, Kimi Code y Codex, terminas abriendo tres o cuatro terminales a la vez. De eso se trata la siguiente categoría.
Administradores de agentes: la orquestación
De estas herramientas de consola surge el término agent orchestration: usar un agente principal (por ejemplo Claude Code con Fable 5, el modelo más caro y capaz, para armar la planificación) y delegar las tareas menores a modelos más baratos vía OpenCode, Codex o cualquier otra suscripción.
tmux: el abuelo de todos
tmux ni siquiera es una herramienta de IA — existe desde hace muchos años. Permite dividir la terminal en múltiples paneles y pestañas, y era el pan de cada día de sysadmins y de cualquiera que viviera en la terminal. El problema: necesitas memorizar atajos de teclado y dedicarle horas de práctica. Con la ola de IA, la mayoría quiere algo similar pero mucho más fácil de usar — sobre todo quienes hacen vibe coding.
cmux y Conductor (solo Mac)
cmux suena a tmux, pero es una aplicación de escritorio con interfaz gráfica donde ejecutas múltiples terminales, y cada terminal puede ser un agente distinto: uno Claude Code, otro Codex, otro OpenCode. Es muy estable y popular, pero solo está disponible para Mac.
Conductor sigue la misma idea — chats al lado, terminales ejecutándose al centro — y también está solo para Mac por ahora. Al final es casi lo mismo que ofrece Codex Desktop o Claude Code Desktop, solo que en el centro, en lugar de texto renderizado, tienes terminales reales de distintos proveedores. Por eso han ganado tanta popularidad: mucha gente paga varias suscripciones y quiere una interfaz que las unifique.
Orca: open source y multiplataforma
Orca hace lo mismo, pero es enteramente open source y multiplataforma. Y tiene algo muy interesante: las terminales se pueden comunicar entre sí. Si ejecutas una terminal con Claude Code, esta puede enviarle instrucciones a otra que corre Codex, Kimi u OpenCode. Suma explorador de archivos, editor de código y la posibilidad de abrir varios proyectos a la par.
En mi opinión, esto es el editor de código de esta época. Los editores tradicionales ya no son tan populares como hace dos años — no han muerto, pero en estas interfaces navegar entre archivos ya no es la tarea principal sino una tarea de review. Lo principal es que la IA genere el código.
Algo más a tomar en cuenta: estas herramientas están ofreciendo integración con aplicaciones móviles, porque muchos quieren controlar a su agente desde el celular — conectarlo con Telegram o Slack, enviar instrucciones desde ahí, y que se ejecute en un servidor o en tu computadora de escritorio. Es algo que veremos mucho más en los próximos meses.
Traycer: contexto compartido entre agentes
Traycer es otra alternativa de escritorio con múltiples terminales, pero con una diferencia clave: realmente comparte el contexto entre agentes. No es solo delegar una tarea a otra terminal — lo que un agente escribe, el otro lo puede leer, porque internamente comparten archivos de planificación en markdown que la propia herramienta administra. No soporta todos los agentes que existen, pero el truco de reutilizar contexto vía markdown funciona bastante bien.
Superset
Superset es otro proyecto con la misma idea, pero todavía está en preview — tienes que pedir acceso.
Herdr: mi favorito
Herdr es relativamente nuevo, pero lo hace muy bien. No es una aplicación de escritorio sino un comando que al ejecutarlo abre múltiples terminales dentro de una misma terminal, con contexto compartido y delegación entre agentes. Consume muy poco, puedes instalarlo en un servidor, tiene plugins, y me recuerda bastante al proyecto Neovim en su filosofía. Es open source e incluso puedes conectarlo con un bot de Telegram para enviarle instrucciones.
Llevo un par de semanas usándolo y actualmente es mi forma favorita de lanzar instancias de Claude Code. De hecho, hace poco publiqué un video sobre cómo ejecutar Claude Code en un servidor, y una pregunta recurrente era cómo levantar nuevas sesiones si ya está instalado en el server. Herdr resuelve exactamente eso: lo instalas en un VPS, le envías instrucciones, y puede abrir una instancia de Claude Code, otra de Codex, e incluso hacer que se comuniquen entre ellas.
¿Cuándo usar estas herramientas?
Solo si realmente necesitas orquestar agentes: aprovechar todas tus suscripciones, hacer que los agentes se comuniquen y elaborar planificaciones grandes exprimiendo todos los tokens que pagas. Si estás aprendiendo y todavía no dominas ni un agente, empieza con uno solo, quédate ahí y avanza. Estas herramientas vienen después.
Editores de código: VS Code, Cursor y Antigravity
Los editores también se subieron a la ola y ahora ofrecen interfaces similares a estas aplicaciones de escritorio.
- VS Code tiene su Agents Window: un clic y lanza una interfaz donde los archivos pasan a segundo plano y puedes abrir múltiples sesiones, muy similar a lo que ofrece Codex Desktop. El problema es la suscripción: lo usarías con Copilot, que es caro.
- Cursor tiene su editor de siempre más su Agents Window, que de hecho es la ventana que se instala por defecto para usuarios nuevos. Cursor está apostando a que la mayoría de sus usuarios sean vibe coders o gente que maneja múltiples sesiones a la vez, aunque con un clic vuelves al IDE tradicional. Su punto fuerte es la suscripción: es bastante barato y con pocos dólares accedes a muchos modelos, incluido su modelo propio Composer.
- Antigravity es el editor de Google, ahora en su versión 2.0, con la misma idea: interfaz de múltiples agentes más su propio CLI, todo alrededor de Gemini. En mi opinión está menos trabajado que Cursor, pero tiene sentido si ya pagas una suscripción de Google.
Mi resumen aquí: si escribes código y quieres un editor, úsalos, son bastante utilizables. Pero si lo que quieres es un administrador de agentes, las interfaces dedicadas de la sección anterior son mucho mejores en ese aspecto.
Mención aparte: Hermes y OpenClaw
Dejé fuera dos agentes que valen la pena mencionar: Hermes y OpenClaw. La razón es que no son agentes de código — son asistentes personales.
Yo uso Hermes a diario como mi asistente: lee correos, asigna tareas, se conecta con el calendario, descarga contenido. Si quieres un asistente de ese estilo, yo iría por Hermes antes que por OpenClaw. Obviamente pueden escribir código — Hermes tiene skills bastante interesantes — pero no es su fuerte. Yo uso Hermes con GPT 5.6, y aunque el modelo es bueno, no ofrece la misma calidad que usar Codex directamente. Y no tiene nada de malo: Hermes es un harness abierto pensado para múltiples proveedores, pero su uso principal es ser asistente de día a día. Lo ideal es delegarle la tarea de que él ejecute Codex o Claude Code por ti.
Hermes tiene aplicación de escritorio y de consola (su forma principal), y se comunica con Telegram, porque la idea de este tipo de agente es estar encendido 24/7. OpenClaw hace lo mismo, pero en cuanto a aplicaciones cliente es de lo más flojo que hay — hace poco lanzaron su app móvil y era puro AI slop.
Warp: la terminal que pivotó
Sé que me lo van a mencionar: Warp era una terminal enfocada en comandos hace un año y algo, pero como hoy la mayoría usa la terminal principalmente para ejecutar agentes de código, también pivotó a ser un agent manager con panel lateral para ejecutar múltiples asistentes.
La interfaz me gusta y es usable, pero no la uso porque carga demasiado — de una terminal esperas que sea muy rápida. Yo prefiero terminales más pequeñas y minimalistas como WezTerm, Alacritty o Kitty. Otro punto: Warp espera que uses su suscripción de IA (ellos también proveen modelos), y en mi caso no necesito ese tipo de interfaz solo por el panel lateral. Aún así es un buen proyecto; si te gusta, úsalo.
Resumen: ¿cuál elegir?
Si estás empezando y quieres algo simple — instalar y ya — ve por las aplicaciones de escritorio: si solo usas GPT, Codex Desktop; si solo usas Claude, Claude Code Desktop; si quieres modelos variados, OpenCode Desktop.
Si ya manejas la terminal, lo mismo: Codex y Claude Code son de lo mejorcito que hay, y OpenCode destaca por la variedad de modelos a menor precio.
Si quieres orquestar múltiples suscripciones, ahí entran los administradores de agentes. Mi favorito es Herdr (liviano, un solo comando, instalable en servidor), y si prefieres interfaz gráfica, Orca está muy bien y es open source multiplataforma.
Hermes u OpenClaw déjalos para después, cuando quieras un asistente de IA aparte — normalmente se instalan en un VPS o servidor.
Los editores de código los uso cada vez menos. Sigo con Cursor, pero por la suscripción barata más que por la interfaz: es un buen puente si todavía estás pegado al editor y quieres migrar de a poco a un administrador de agentes.
En mi día a día salto entre varias: Herdr con suscripciones de Claude Code más Codex, a veces Claude Code Desktop o Cursor, y Hermes como asistente diario. Y es que los benchmarks cambian constantemente — hoy se habla de Kimi K3, mañana sale GLM o MiniMax con una nueva versión — y estas interfaces resuelven justamente el poder combinar todas tus suscripciones sin casarte con una.
De momento estas son las categorías que existen: escritorio, consola, orquestadores y editores con interfaz de agentes. No veo una categoría nueva en el horizonte, pero si aparece algo, se los estaré compartiendo.
Si tienes alguna duda o sugerencia, déjala en los comentarios. Y si quieres una asesoría personalizada sobre cualquiera de estos temas, puedes reservarla en fazt.dev.