Oui, vous pouvez faire tourner un agent IA gratuit directement sur votre PC. Le montage le plus accessible associe Hermes Agent, Ollama et un modèle à poids ouverts. Vous ne louez pas de serveur et vous ne payez pas chaque réponse à une API.
Le logiciel et le modèle peuvent coûter zéro euro si vous possédez déjà la machine. L’électricité, le temps d’installation et les services externes appelés par l’agent restent des coûts réels. Un agent qui utilise une recherche web payante ou envoie des SMS n’est plus entièrement gratuit.
Pourquoi l’installer sur votre ordinateur ?
Le modèle tourne sur localhost, l’adresse interne de votre PC. Les demandes envoyées au modèle ne partent pas vers un fournisseur d’IA. Vous gardez aussi les conversations, les compétences et la mémoire sur votre disque.
Cette installation a une limite très concrète : l’agent s’arrête quand votre ordinateur dort ou s’éteint. Il partage aussi la mémoire vive et le processeur avec vos autres logiciels. Pour un premier agent personnel, je préfère cette contrainte à un serveur exposé sur Internet qu’il faudrait sécuriser et maintenir.
« Local » ne veut pas dire « sans réseau ». Si vous demandez à l’agent de visiter un site, d’appeler votre CRM ou d’envoyer un message, ces outils communiquent avec l’extérieur. Seul le calcul du modèle reste sur le PC.
Le montage : Hermes Agent, Ollama et un modèle local
Hermes Agent fournit la boucle de travail, le terminal, les fichiers, la mémoire, les compétences et les validations. Le projet est publié sous licence MIT.
Ollama télécharge le modèle et le sert localement. Hermes lui envoie les demandes sur http://localhost:11434/v1. Aucun VPS ne se trouve entre les deux.
Le modèle choisit les actions. Prenez un modèle entraîné à appeler des outils, avec une fenêtre de contexte suffisante. Un petit modèle de conversation peut très bien écrire un paragraphe et échouer dès qu’il doit enchaîner plusieurs fichiers et commandes.
Quels modèles gratuits choisir en 2026 ?
Les modèles changent vite. Au 1er août 2026, je regarderais d’abord Qwen 3.5 et Gemma 4. Les deux familles se téléchargent pour un usage local. Vérifiez toujours la licence du modèle précis avant un usage commercial.
| Machine | Modèle à essayer | Ce que j’en attends |
|---|---|---|
| 8 à 16 Go de RAM | Qwen 3.5 4B quantifié | Test, tri et tâches courtes. Les appels d’outils restent fragiles. |
| 16 à 24 Go | Qwen 3.5 9B | Bon point de départ sur un PC récent, surtout avec une quantification. |
| 32 Go et plus | Gemma 4 31B | Plus régulier pour les tâches longues et les outils, mais plus lent. |
Huit gigaoctets peuvent suffire pour essayer un modèle de 3B ou 4B. Je ne vendrais pas cette configuration comme un agent fiable. La mémoire du modèle s’ajoute à la fenêtre de contexte, au système et aux outils. Sur une machine trop juste, le PC bascule sur le disque et chaque action prend beaucoup plus de temps.
1. Choisir la première mission
Commencez avant l’installation. Écrivez une mission qui tient en une phrase et un résultat que vous pourrez ouvrir. Par exemple : lire les factures PDF d’un dossier de test et produire un tableau CSV avec le fournisseur, la date et le montant.
Notez la source qui fait foi, les fichiers autorisés et les actions interdites. Pour comprendre cette différence entre un modèle, un outil et un agent, lisez d’abord Agent IA : c’est quoi ?
2. Installer Ollama et télécharger le modèle
Installez Ollama depuis son site officiel. Ouvrez ensuite un terminal et téléchargez un modèle. Pour un PC avec assez de mémoire, Qwen 3.5 9B donne un point de départ raisonnable :
ollama pull qwen3.5:9b
OLLAMA_CONTEXT_LENGTH=65536 ollama serveSur macOS et Windows, l’application Ollama permet aussi de régler la longueur de contexte. La valeur demandée par Hermes est de 64 000 tokens minimum. Ce réglage augmente fortement la mémoire utilisée. Si le modèle ne tient plus, prenez une version plus petite ou réduisez la mission. Ne cachez pas le problème en donnant à Hermes une valeur différente de celle réellement servie par Ollama.
3. Installer Hermes Agent
Sur Linux, macOS ou WSL2 :
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
hermes setupSur Windows, dans PowerShell :
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
hermes setupDans l’assistant de configuration, choisissez Custom Endpoint. Saisissez http://localhost:11434/v1 comme adresse, laissez la clé vide et indiquez qwen3.5:9b comme modèle. Donnez 64 000 comme longueur de contexte, en accord avec le réglage Ollama.
La documentation officielle Hermes pour Ollama maintient les commandes et les modèles recommandés à jour.
4. Tester sans donner les clés de la maison
Créez un dossier avec des copies de documents. Lancez Hermes depuis ce dossier et demandez le livrable défini à la première étape. Refusez l’accès à votre boîte mail, à votre banque et à vos dossiers personnels pendant les essais.
Contrôlez les fichiers produits, les commandes exécutées et les erreurs. Rejouez plusieurs cas connus. Un agent local peut se tromper comme un agent dans le cloud. La différence est l’endroit où le modèle calcule, pas sa capacité à dire vrai.
Quand les sorties tiennent, ouvrez un outil supplémentaire. Pour un e-mail client, un paiement, une suppression ou une publication, gardez une validation humaine. La page agent conversationnel montre comment je pose cette limite dans un usage d’entreprise.
Ce qu’un agent IA gratuit fera moins bien
Un modèle local de 4B ou 9B perd plus facilement le fil sur une mission longue. Il choisit parfois le mauvais outil ou produit un appel mal formé. Le temps de réponse dépend beaucoup du PC. Sans carte graphique adaptée, une suite d’actions peut durer plusieurs minutes.
Je réserverais donc le local gratuit aux tâches bornées, aux données sensibles et aux essais. Pour une opération qui doit tourner quand votre PC est fermé, il faudra ensuite une machine toujours allumée ou un hébergement. Ce choix vient après la preuve que l’agent livre correctement.
Faire installer votre premier agent local
Le modèle peut rester gratuit. Le travail de set-up consiste à choisir la bonne taille pour votre PC, installer Hermes et Ollama, écrire la mission, limiter les droits puis tester le livrable sur vos cas.
Ambactos peut faire ce set-up directement sur votre machine. On commence par vérifier la mémoire disponible et la tâche. Si le PC ne suffit pas, je vous le dis avant l’installation. La manière de définir le périmètre est détaillée dans le chiffrage d’un mandat agentique.
Agent de découverte · En formation