La queja más grande sobre los CLI de codificación de IA no es el modelo, es la desviación. Haz la misma pregunta a Codex o Claude Code dos veces y las respuestas pueden variar de formas que rompan la automatización. La solución que circula en los foros de desarrolladores es aburridamente simple: pon tus instrucciones permanentes en un archivo de prompt, versiciónalo y deja de escribirlas de nuevo.
Revisamos 8 herramientas de escritorio para gestionar prompts, reglas y ejecuciones de evaluación para asistentes de codificación de IA. Cada una envió una versión real de 2025. Todas son gratuitas o tienen un nivel gratuito genuino.
Qué buscar en una aplicación de gestión de prompts
La gestión de prompts no es una sola cosa. Se encuentra en la intersección del control de versiones, la experiencia del desarrollador y la infraestructura de evaluación.
- Reglas basadas en archivos que viven en el repositorio. No un fragmento guardado en la nube de algún proveedor.
- Reglas con alcance de repositorio y directorio. Un monorrepositorio necesita una orientación diferente en
apps/web/yapps/api/. - Archivos de persona por proyecto (AGENTS.md, CLAUDE.md, .cursor/rules). Soporte para los nombres de archivo que la herramienta realmente lee.
- Evaluación y pruebas de regresión en el prompt mismo. Si editas las reglas, necesitas saber si los resultados mejoraron o empeoraron.
- Diferenciable y revisable. Un cambio de prompt es un cambio de código; los PR sobre él hacen que el equipo sea más sano.
Tabla de comparación rápida
| App | Mejor para | Plataformas | Plan gratuito | Precio inicial/mes | Valoración |
|---|---|---|---|---|---|
| OpenAI Codex CLI | Flujos de trabajo AGENTS.md específicos de Codex | Windows, macOS, Linux | CLI Completo | Costo de API por solicitud | Mantenido activamente |
| Claude Code | Orientación CLAUDE.md a nivel de repositorio | Windows, macOS, Linux | CLI Gratuito | Requiere suscripción a Claude | Bien valorado entre equipos de desarrollo |
| Aider | CLI de programador en pareja de código abierto | Windows, macOS, Linux | CLI Completo | Costo de API por solicitud | Muy valorado en GitHub |
| Continue | Agente de VS Code y JetBrains | Windows, macOS, Linux | Extensión gratuita | Costo de API por solicitud | Favorito de la comunidad |
| Cursor Rules | Archivos de reglas del editor Cursor | Windows, macOS, Linux | Nivel gratuito en Cursor | Alrededor de $20/mes Cursor Pro | Ecosistema de reglas en Cursor |
| promptfoo | Evaluación de prompts local y regresión | Windows, macOS, Linux | Completamente gratuito | Gratuito | Ampliamente utilizado en flujos de trabajo de evaluación |
| PromptLayer | Versionamiento de prompts y observabilidad | Web, CLI | Nivel gratuito | Alrededor de $50/mes planes de equipo | Adoptado por equipos |
| LangSmith | Observabilidad LLM de extremo a extremo | Web, SDK | Nivel gratuito | Alrededor de $39/mes por desarrollador | Estándar en tiendas LangChain |
Las aplicaciones
1. OpenAI Codex CLI – Mejor para archivos de reglas específicos de Codex
OpenAI Codex CLI lee un archivo AGENTS.md en la raíz del repositorio y aplica la orientación en él a cada solicitud. Ese es el archivo donde suceden las correcciones de una línea: “al escribir Python, preferir explícito from __future__ import annotations”, “nunca modificar migraciones sin pedir”. Los directorios anidados también pueden llevar su propio AGENTS.md.
Dónde se queda corto: Las reglas solo surten efecto a través del CLI de Codex mismo. Otros CLI ignoran completamente el archivo.
Precios:
- Gratuito: CLI gratuito
- Pagado: Costo por solicitud contra la API de OpenAI
Plataformas: Windows, macOS, Linux (Node.js)
Descargar: GitHub
Conclusión: Si usas Codex, un AGENTS.md es el cambio de mayor impacto que puedes hacer.
2. Claude Code – Mejor para instrucciones de repositorio específicas de Claude
Claude Code lee CLAUDE.md en la raíz del repositorio y archivos CLAUDE.md en capas en subdirectorios. Las reglas son aditivas y tienen alcance de directorio, que es exactamente la forma que quieres para un monorrepositorio. Los comandos de slash y las habilidades amplían el mismo modelo basado en archivos.
Dónde se queda corto: Las reglas son específicas de Claude. Compartirlas entre CLI requiere copiar-pegar o un enlace simbólico.
Precios:
- Gratuito: CLI gratuito
- Pagado: Requiere una suscripción a Claude o clave de API
Plataformas: Windows, macOS, Linux
Descargar: Sitio oficial
Conclusión: El equivalente de AGENTS.md para Claude Code, y se aplica el mismo razonamiento: pon las reglas en el repositorio.
3. Aider – Mejor programador en pareja de código abierto
Aider es el CLI que inició toda la tendencia de archivos de prompt. Su mecanismo CONVENTIONS.md permite que un equipo confirme reglas permanentes junto con el código, y Aider las mostrará en cada llamada. Funciona con cualquier punto final compatible con OpenAI, así que la misma configuración funciona contra Codex, Claude o un modelo local.
Dónde se queda corto: La interfaz de chat es menos pulida que los CLI del proveedor.
Precios:
- Gratuito: Todo
- Pagado: Costo por solicitud contra cualquier API de modelo al que lo apuntes
Plataformas: Windows, macOS, Linux (Python)
Descargar: GitHub
Conclusión: La mejor opción si quieres un archivo de prompt que sobreviva al cambio de proveedor de modelo.
4. Continue – Mejor para configuración de prompts incrustada en editor
Continue es la extensión de código abierto que vive dentro de VS Code y JetBrains. Su config.json y .continue/config.yaml por repositorio permiten que un equipo fije modelos, prompts de sistema y comandos de slash directamente en el repositorio.
Dónde se queda corto: Vinculado al editor. Si también trabajas en un CLI de solo terminal, necesitas una segunda configuración.
Precios:
- Gratuito: Extensión completa
- Pagado: Costo por solicitud contra tu proveedor elegido
Plataformas: VS Code, JetBrains, todos los SO principales
Descargar: Sitio oficial · GitHub
Conclusión: La opción correcta para flujos de trabajo centrados en editor donde el CLI no es la interfaz principal.
5. Cursor Rules – Mejor para usuarios de Cursor
Cursor Rules es el diseño de archivo .cursor/rules/*.mdc que Cursor recoge automáticamente. Un archivo de regla puede limitarse a un glob de directorio, lo que es útil para evitar que las reglas de SQL se activen en archivos React.
Dónde se queda corto: Específico de Cursor. Los miembros del equipo en otros editores no se benefician.
Precios:
- Gratuito: Nivel gratuito de Cursor
- Pagado: Alrededor de $20/mes para Cursor Pro
Plataformas: Windows, macOS, Linux (editor Cursor)
Descargar: Sitio de Cursor · Documentación de reglas
Conclusión: Solo vale la pena configurar si todo el equipo está en Cursor.
6. promptfoo – Mejor para pruebas de regresión de cambios de prompt
promptfoo es el framework de evaluación que hace que los archivos de prompt sean revisables. Apúntalo a un prompt, define un pequeño conjunto de inputs de prueba, ejecútalo contra múltiples modelos y obtén una comparación. Cuando editas las reglas, descubres qué casos mejoraron y cuáles se rompieron antes de que se envíe el cambio.
Dónde se queda corto: La configuración requiere una hora la primera vez. Eventualmente, todos desearían haberlo hecho antes.
Precios:
- Gratuito: Todo, licenciado bajo MIT
- Pagado: No aplica
Plataformas: Windows, macOS, Linux (Node.js)
Descargar: GitHub
Conclusión: La herramienta que convierte ediciones de prompt de vibes a ingeniería.
7. PromptLayer – Mejor para versionamiento de prompts a nivel de equipo
PromptLayer trata los prompts como activos de primera clase: versionamiento, etiquetado, despliegue y observabilidad de cómo se desempeña cada versión en producción. Si tus prompts se ejecutan detrás de una API que enfrenta al cliente, esta es la capa que te mantiene cuerdo.
Dónde se queda corto: Basado en la nube; la opción de auto-hospedaje no es la predeterminada. Las características de equipo suben el precio.
Precios:
- Gratuito: Nivel individual con solicitudes limitadas
- Pagado: Planes de equipo comenzando alrededor de $50/mes
Plataformas: Web, SDK de Python y JavaScript, CLI
Descargar: Sitio oficial
Conclusión: Excesivo para un desarrollador solo, esencial una vez que un equipo tiene prompts en producción.
8. LangSmith – Mejor para observabilidad LLM de aplicación de extremo a extremo
LangSmith es el producto de trazado y evaluación de LangChain. Captura cada llamada de modelo que hace una aplicación, las agrupa por traza y te permite reproducir cualquier interacción contra un nuevo prompt o modelo. Prompt Hub permite que los equipos compartan y versionicen plantillas de prompt en una base de código.
Dónde se queda corto: El valor es mayor dentro de bases de código basadas en LangChain. Fuera de ese ecosistema, el trabajo de configuración es real.
Precios:
- Gratuito: Nivel de desarrollador
- Pagado: Alrededor de $39/mes por desarrollador para el nivel pagado
Plataformas: Web, SDK de Python y JavaScript
Descargar: Sitio oficial
Conclusión: La opción correcta si la base de código ya se ejecuta en LangChain, menos convincente de otro modo.
Cómo elegir la correcta
- Si usas OpenAI Codex CLI: OpenAI Codex CLI con
AGENTS.mden la raíz del repositorio. Nada más necesario para empezar. - Si usas Claude Code:
CLAUDE.mden la raíz del repositorio, más subdirectorioCLAUDE.mdpara reglas con alcance. - Si cambias entre modelos: Aider, porque el archivo de regla sigue a la herramienta, no al proveedor.
- Si vives en VS Code o JetBrains: Continue.
- Si tu equipo está en Cursor: Cursor Rules bajo
.cursor/rules/. - Antes de que edites un prompt de el cual otros dependen: ejecuta promptfoo contra un pequeño conjunto de evaluación. Requiere una hora para configurar y ahorra días.
- Una vez que los prompts llegan a producción: PromptLayer o LangSmith, dependiendo de tu stack.
FAQ
¿Qué es un archivo AGENTS.md?
AGENTS.md es un archivo de raíz de repositorio que el CLI de OpenAI Codex lee en cada solicitud. Es donde colocas reglas permanentes, guías de estilo y correcciones de una línea para la desviación más común de la herramienta.
¿Cómo es diferente CLAUDE.md de AGENTS.md?
Misma idea, herramienta diferente. Claude Code lee CLAUDE.md; CLI de Codex lee AGENTS.md. Las reglas actualmente no se aplican de forma cruzada.
¿Necesito una herramienta de pago para gestionar prompts? No. Aider, promptfoo, Continue y los archivos de reglas nativos del CLI son todos gratuitos. Las herramientas de pago (PromptLayer, LangSmith) se vuelven valiosas una vez que tienes prompts ejecutándose en producción.
¿Cómo evalúo si un cambio de prompt es una mejora? Usa promptfoo. Define 10 a 20 inputs realistas, ejecuta los prompts antiguos y nuevos contra ellos y compara. No juzgues por una sola verificación puntual.
¿Puedo compartir prompts entre Codex, Claude Code y Aider?
CONVENTIONS.md de Aider es portátil, pero cada CLI de proveedor lee su propio archivo. Un patrón que funciona es un archivo de regla canónico más enlaces simbólicos o un script que lo copia a la ubicación esperada de cada proveedor.
¿Son los archivos de prompt un riesgo de seguridad? Pueden serlo, si secretos o URLs privadas terminan en ellos. Tratalos como código: sin credenciales, sin endpoints solo internos, revisión de código antes de fusionar.