OpenHands : un agent développeur sur modèle local
OpenHands donne à un agent un terminal, un navigateur et votre dépôt, puis le laisse travailler : il planifie, modifie des fichiers, lance des commandes dans un bac à sable, lit la sortie et recommence jusqu'à ce que la tâche aboutisse ou qu'il abandonne. Le faire tourner sur un modèle local est possible, et réclame un modèle bien plus gros que ce que la plupart des gens ont. Voici où passe réellement la ligne.
#Ce qu'il fait, concrètement
Vous décrivez une tâche en français. Il inspecte le dépôt, se fait un plan, puis agit en boucle : lancer une commande, lire le résultat, modifier un fichier, relancer les tests, lire l'échec, corriger. Cette boucle est le produit. On est plus près d'un stagiaire avec un terminal que d'une complétion automatique.
Les conséquences suivent. Chaque itération est une génération complète sur un contexte qui grossit : une tâche en dix étapes coûte dix longs prompts. Et comme l'agent agit au lieu de suggérer, son rayon d'action est tout ce qu'il peut atteindre — ce qui explique pourquoi le bac à sable fait partie de la conception et non des réglages.
#L'exigence de modèle, sans détour
Ce guide t'amène au modèle. Le kit t'amène au copilote qui code dans ton éditeur.
- Espace en ligne à vie
- PDF + fichiers
- Remboursé 30 j
| Classe de modèle | Résultat réaliste |
|---|---|
| 7 à 8 milliards | Échoue. Commandes mal formées, sortie mal lue, boucles sur le même fichier. |
| 14 milliards | Réussit parfois des tâches triviales sur un seul fichier. Peu fiable. |
| 27 à 32 milliards | Le plancher praticable. Les tâches étroites et bien spécifiées aboutissent assez souvent pour être utiles. |
| 70 milliards et plus | Jugement nettement meilleur, assez lent pour qu'on lance la tâche et qu'on aille faire autre chose. |
Deux capacités comptent plus que les scores de benchmark : l'appel d'outils dans le format exact attendu, et la stabilité sur contexte long, puisque l'agent relit un historique croissant à chaque étape. Un modèle excellent pour écrire une fonction à partir d'un prompt peut être inutilisable en boucle. Les modèles orientés code battent en général les modèles de discussion de même taille sur cet exercice.
#Le faire tourner en local
- 01Servir un modèle
- 02Démarrer l'application dans sa configuration conteneurisée
- 03Le pointer vers votre point d'accès local
- 04Monter un seul dépôt
- 05Commencer par une tâche petite et vérifiable
- Servir un modèle avec un contexte long
- Faire relire du code par un modèle local
- Cline : l'agent de code intégré à l'éditeur
#La sécurité n'est pas optionnelle
- Aucun secret dans l'environnement
- L'agent lit son propre environnement et peut l'afficher.
- Une branche jetable et un clone de travail
- Jamais votre copie de travail avec des modifications non validées.
- Accès réseau restreint
- Un agent qui peut joindre n'importe quoi peut exfiltrer tout ce qu'il a lu.
- Tout contenu récupéré est hostile par défaut
- La description d'un ticket ou un fichier README peuvent contenir des instructions destinées à l'agent.
- Relire chaque diff
- « Les tests passent » signifie que les tests passent, pas que la modification est correcte.
#Quand un assistant vaut mieux qu'un agent
| Tâche | Meilleur outil |
|---|---|
| Complétion pendant la frappe | Une extension d'éditeur |
| Une modification qu'on peut décrire fichier par fichier | Un assistant conversationnel avec le fichier ouvert |
| Une tâche en plusieurs étapes avec un test de réussite clair | OpenHands, si le modèle est assez gros |
| Du code que vous ne pouvez pas relire | Aucun des deux : vous ne pourrez pas vérifier le résultat |
#FAQ
OpenHands peut-il tourner sur un modèle local ?+
Quel est le modèle minimum ?+
Est-ce prudent de le lancer sur ma machine ?+
Combien de VRAM faut-il ?+
Pourquoi l'agent répète-t-il la même étape ?+
Un retour, une erreur, une précision ? Faites-nous signe, ça améliore le guide pour tout le monde.