← Back to Home

Improve: Use Your Best AI Model to Audit Codebases and Write Plans for Cheaper Agents to Execute

Improve: Use Your Best AI Model to Audit Codebases and Write Plans for Cheaper Agents to Execute

AI coding agents are transforming how we write software, but there's a problem. Running your most powerful model (Opus, GPT-4.8, Gemini Ultra) on every small change is expensive, slow, and wasteful. The smaller models are cheap and fast, but they lack the architectural judgment to plan complex changes on their own.

shadcn/improve — from the creator of shadcn/ui — solves this with a clean architectural split. Your most capable model audits the codebase, understands the architecture, and writes detailed implementation plans. Cheaper models then execute those plans in isolated worktrees. The result: Opus-level architecture decisions at GPT-4o-mini execution prices.

With 3,654+ GitHub stars in just 4 days, improve is one of the fastest-growing developer tools of June 2026. It's open-source under MIT, self-hosted, and works with any agent that supports the Agent Skills format.

Architecture

Improve Architecture

The workflow is structured around a clear separation of concerns:

  • Advisor (expensive model): Runs the /improve command. Maps the repo structure, fans out parallel audit subagents across 9 categories (correctness, security, performance, test coverage, tech debt, dependencies, DX, docs, feature direction), vets every finding by re-reading cited locations, prioritizes by leverage (impact ÷ effort), and writes self-contained plan files into plans/.

  • Plans Directory: Each plan is a standalone markdown file with current-state code excerpts, exact steps, verification gates (commands + expected output), and hard STOP conditions. Plans are written for the weakest plausible executor — any model (or human) can pick one up.

  • Executor (cheap model): Runs /improve execute <plan> in an isolated git worktree. Follows the plan step by step, runs every verification gate, and reports back. The advisor reviews the resulting diff against the plan — approve (merging stays your call), send back for revision (max 2 rounds), or block and refine the plan.

Why It's Trending

Three forces make improve take off:

  1. The model price gap is widening. Claude Opus 4.8 costs ~$75/M input tokens while Haiku 3.5 costs ~$0.80/M. Using Opus to plan and Haiku to execute gives you nearly identical output quality at 1% of the cost.

  2. Agent interoperability is emerging. The Agent Skills format lets skills like improve run in Claude Code, Codex, Cursor, and any OpenHands-compatible agent. The plans improve writes are plain markdown — any tool can read them.

  3. AI-generated code needs review. improve bakes the review into the workflow. The advisor re-reads every cited location during audit, the executor is reviewed after execution, and the reconcile command verifies nothing drifted between sessions.

Prerequisites

  • Node.js 18+ (for npx skills add)
  • An agent that supports Agent Skills — Claude Code, Codex, Cursor, or any OpenHands-compatible agent
  • Git (for worktree isolation during plan execution)
  • A capable LLM API key (Claude, OpenAI, Gemini — whichever you use for your agent)
  • The skill itself: npx skills add shadcn/improve

Installation and Setup

1. Add the Skill

npx skills add shadcn/improve

This downloads the skill to your agent's skills directory.

2. Verify Installation

In your agent, run:

/improve quick

If the skill is loaded correctly, it will perform a quick pass of your current repository — mapping the stack, running a lightweight audit, and presenting findings.

3. First Full Audit

For a comprehensive analysis:

/improve

This runs the full pipeline: recon → audit (9 categories) → vet → prioritize. After ~30-60 seconds (depending on repo size), you'll see a findings table:

| # | Finding                                | Category  | Effort | Confidence |
|---|----------------------------------------|-----------|--------|------------|
| 1 | Shadow config duplicated in 3 files    | tech-debt | M      | HIGH       |
| 2 | O(n²) icon migration loop              | perf      | S      | HIGH       |

4. Generate Plans

Reply with the findings you want planned:

plan 1, 3 and 5

The skill writes one markdown file per finding into plans/, plus an index file with the recommended execution order.

5. Execute a Plan

/improve execute 001

This creates an isolated git worktree, spawns a cheaper model, hands it the plan, and reviews the result. It never touches your working tree directly — merging is always yours.

6. Daily Reconcile

Before starting new work:

/improve reconcile

This checks what's landed since the last session, refreshes plans that drifted, and retires findings that got fixed independently.

Advanced Usage

Focused Audits

/improve security        # Security-focused audit only
/improve perf            # Performance hotspots
/improve tests           # Test coverage gaps
/improve branch          # Audit only what your current branch changes

Skip Audit, Plan Directly

If you already know what you want done:

/improve plan "Extract the payment gateway into a separate module"

Review an Existing Plan

/improve review-plan plans/003-refactor-auth.md

Publish Plans as GitHub Issues

/improve ... --issues

This publishes every plan as a well-formatted GitHub issue — self-contained, with file paths, code excerpts, and verification gates.

How It Works: Under the Hood

The skill uses a multi-stage pipeline:

Recon. Reads your repo's stack, conventions, and exact build/test/lint commands. It also ingests intent docs (ADRs, PRDs, DESIGN.md) so decided tradeoffs aren't re-flagged as findings.

Audit. Fans out parallel subagents across 9 categories. Each subagent has expertise in its domain — the security subagent knows OWASP patterns, the perf subagent looks for N+1 queries and memory leaks.

Vet. The advisor re-reads every cited location itself before presenting findings. False positives get dropped with recorded reasons (so they don't return next run).

Prioritize. Findings are scored by leverage: (impact × confidence) ÷ effort. The highest-leverage items appear first.

Plan. Each plan file contains:

  • File paths with current-state code excerpts
  • Step-by-step implementation instructions
  • Verification gates with expected output
  • Hard STOP conditions
  • The git commit hash it was written against

Execute. Creates a disposable worktree, runs the plan through a cheaper model, checks the diff against the plan's criteria, and reports a verdict.

Comparison with Alternatives

  • GitHub Copilot Workspace: Proprietary, cloud-only, less granular control over which model audits vs. executes. improve is open-source and self-hosted.
  • OpenHands / OpenDevin: Full coding agent, not a plan-first workflow. improve focuses on planning and lets you mix and match executors.
  • Cursor Agent: Tied to Cursor IDE. improve works with any agent (Claude Code, Codex, Cursor, or plain terminal).
  • Aider: Excellent for pair programming, but doesn't have the plan-audit-execute separation that improve brings.

Resources

← Retour à l'Accueil

Improve : Utilisez votre meilleur modèle d'IA pour auditer vos projets et générer des plans exécutables par des agents moins coûteux

Improve : Utilisez votre meilleur modèle d'IA pour auditer vos projets et générer des plans exécutables par des agents moins coûteux

Les agents de codage IA transforment la façon dont nous écrivons des logiciels, mais il y a un problème. Utiliser votre modèle le plus puissant (Opus, GPT-4.8, Gemini Ultra) pour chaque petite modification est coûteux, lent et gaspilleur. Les modèles plus petits sont économiques et rapides, mais ils manquent du jugement architectural nécessaire pour planifier des changements complexes.

shadcn/improve — du créateur de shadcn/ui — résout ce problème avec une séparation architecturale claire. Votre modèle le plus capable audite le codebase, comprend l'architecture et rédige des plans d'implémentation détaillés. Des modèles moins coûteux exécutent ensuite ces plans dans des environnements de travail isolés. Le résultat : des décisions architecturales de niveau Opus au prix d'exécution de GPT-4o-mini.

Avec plus de 3 654 étoiles GitHub en seulement 4 jours, improve est l'un des outils de développement qui connaît la croissance la plus rapide en juin 2026. Il est open-source sous licence MIT, auto-hébergé et fonctionne avec tout agent compatible avec le format Agent Skills.

Architecture

Architecture d'Improve

Le flux de travail est structuré autour d'une séparation claire des responsabilités :

  • Conseiller (modèle coûteux) : Exécute la commande /improve. Cartographie la structure du projet, lance des sous-agents d'audit parallèles dans 9 catégories (correction, sécurité, performance, couverture de tests, dette technique, dépendances, expérience développeur, documentation, direction fonctionnelle), vérifie chaque résultat en relisant les emplacements cités, priorise par effet de levier (impact ÷ effort) et écrit des fichiers de plan autonomes dans plans/.

  • Répertoire Plans : Chaque plan est un fichier markdown autonome contenant des extraits de code actuels, des instructions étape par étape, des portes de vérification (commandes + résultat attendu) et des conditions d'arrêt strictes. Les plans sont écrits pour l'exécuteur le plus faible possible — n'importe quel modèle (ou humain) peut les prendre en charge.

  • Exécuteur (modèle économique) : Exécute /improve execute <plan> dans un git worktree isolé. Suit le plan pas à pas, exécute chaque porte de vérification et fait rapport. Le conseiller examine le diff résultant par rapport au plan — approuve (la fusion vous revient), renvoie pour révision (2 tours max) ou bloque et affine le plan.

Pourquoi cet outil est tendance

Trois forces propulsent improve :

  1. L'écart de prix des modèles se creuse. Claude Opus 4.8 coûte ~75$/M tokens d'entrée tandis que Haiku 3.5 coûte ~0,80$/M. Utiliser Opus pour planifier et Haiku pour exécuter donne une qualité de sortie presque identique pour 1% du coût.

  2. L'interopérabilité des agents émerge. Le format Agent Skills permet aux compétences comme improve de fonctionner dans Claude Code, Codex, Cursor et tout agent compatible OpenHands. Les plans qu'improve écrit sont en markdown simple — n'importe quel outil peut les lire.

  3. Le code généré par IA a besoin de révision. improve intègre la révision dans le flux de travail. Le conseiller relit chaque emplacement cité pendant l'audit, l'exécuteur est révisé après exécution, et la commande reconcile vérifie que rien n'a dérivé entre les sessions.

Prérequis

  • Node.js 18+ (pour npx skills add)
  • Un agent compatible Agent Skills — Claude Code, Codex, Cursor ou tout agent compatible OpenHands
  • Git (pour l'isolation des worktrees pendant l'exécution des plans)
  • Une clé API LLM capable (Claude, OpenAI, Gemini — selon votre agent)
  • La compétence elle-même : npx skills add shadcn/improve

Installation et Configuration

1. Ajouter la Compétence

npx skills add shadcn/improve

Cette commande télécharge la compétence dans le répertoire des compétences de votre agent.

2. Vérifier l'Installation

Dans votre agent, exécutez :

/improve quick

Si la compétence est chargée correctement, elle effectuera un passage rapide de votre dépôt actuel — cartographie de la stack, audit léger et présentation des résultats.

3. Premier Audit Complet

Pour une analyse exhaustive :

/improve

Cela exécute le pipeline complet : reconnaissance → audit (9 catégories) → vérification → priorisation. Après environ 30 à 60 secondes (selon la taille du dépôt), vous verrez un tableau des résultats :

| # | Résultat                               | Catégorie  | Effort | Confiance |
|---|----------------------------------------|------------|--------|-----------|
| 1 | Configuration shadow dupliquée dans 3 fichiers | dette-tech | M      | ÉLEVÉE   |
| 2 | Boucle de migration d'icônes en O(n²)  | perf       | S      | ÉLEVÉE   |

4. Générer des Plans

Répondez avec les résultats que vous souhaitez planifier :

plan 1, 3 et 5

La compétence écrit un fichier markdown par résultat dans plans/, plus un fichier d'index avec l'ordre d'exécution recommandé.

5. Exécuter un Plan

/improve execute 001

Ceci crée un git worktree isolé, lance un modèle économique, lui remet le plan et examine le résultat. Cela ne touche jamais votre arbre de travail directement — la fusion vous revient toujours.

6. Reconcilier Quotidiennement

Avant de commencer un nouveau travail :

/improve reconcile

Ceci vérifie ce qui a été livré depuis la dernière session, rafraîchit les plans qui ont dérivé et retire les résultats qui ont été corrigés indépendamment.

Utilisation Avancée

Audits Ciblés

/improve security        # Audit axé sur la sécurité uniquement
/improve perf            # Goulots d'étranglement de performance
/improve tests           # Lacunes de couverture de tests
/improve branch          # Auditer uniquement ce que votre branche modifie

Sauter l'Audit, Planifier Directement

Si vous savez déjà ce que vous voulez faire :

/improve plan "Extraire la passerelle de paiement dans un module séparé"

Réviser un Plan Existant

/improve review-plan plans/003-refactor-auth.md

Publier les Plans comme Issues GitHub

/improve ... --issues

Ceci publie chaque plan comme une issue GitHub bien formatée — autonome, avec chemins de fichiers, extraits de code et portes de vérification.

Comment ça Fonctionne : Sous le Capot

La compétence utilise un pipeline multi-étapes :

Reconnaissance. Lit la stack de votre dépôt, les conventions et les commandes exactes de build/test/lint. Elle ingère également les documents d'intention (ADRs, PRDs, DESIGN.md) afin que les compromis déjà décidés ne soient pas re-signalés comme des résultats.

Audit. Lance des sous-agents parallèles dans 9 catégories. Chaque sous-agent a une expertise dans son domaine — le sous-agent sécurité connaît les motifs OWASP, le sous-agent performance cherche les requêtes N+1 et les fuites mémoire.

Vérification. Le conseiller relit chaque emplacement cité lui-même avant de présenter les résultats. Les faux positifs sont supprimés avec des raisons enregistrées (afin qu'ils ne reviennent pas à la prochaine exécution).

Priorisation. Les résultats sont notés par effet de levier : (impact × confiance) ÷ effort. Les éléments au plus fort effet de levier apparaissent en premier.

Planification. Chaque fichier de plan contient :

  • Les chemins de fichiers avec des extraits de code actuels
  • Des instructions d'implémentation étape par étape
  • Des portes de vérification avec résultat attendu
  • Des conditions d'arrêt strictes
  • Le hash du commit git sur lequel il a été écrit

Exécution. Crée un worktree jetable, exécute le plan via un modèle économique, vérifie le diff par rapport aux critères du plan et rend un verdict.

Comparaison avec les Alternatives

  • GitHub Copilot Workspace : Propriétaire, cloud uniquement, moins de contrôle granulaire sur quel modèle audite vs. exécute. improve est open-source et auto-hébergé.
  • OpenHands / OpenDevin : Agent de codage complet, pas un flux de travail planification-d'abord. improve se concentre sur la planification et vous permet de mélanger les exécuteurs.
  • Cursor Agent : Lié à l'IDE Cursor. improve fonctionne avec n'importe quel agent (Claude Code, Codex, Cursor ou terminal simple).
  • Aider : Excellent pour la programmation en binôme, mais n'a pas la séparation planification-audit-exécution qu'improve apporte.

Ressources