Aller au contenu
Guides

Modèles gratuits pour OpenClaw

Ce qui fait tourner un agent et ce qui semble seulement bon marché

7 min de lecture

Vous voulez un agent OpenClaw qui répond toute la journée sans facture au compteur derrière chaque message. La référence des fournisseurs liste des dizaines de routes et presque aucune n’est étiquetée gratuite, parce que gratuit recouvre au moins trois arrangements différents : un point de terminaison qui ne facture rien aujourd’hui, un service payant doté d’un palier gratuit, et un modèle que vous faites tourner vous-même sur du matériel que vous possédez déjà. Le mauvais choix échoue rarement bruyamment. Il se manifeste une semaine plus tard, sous la forme d’un agent qui n’appelle plus ses outils, ou qui bloque chaque après-midi sur une limite de débit.

Les voies réellement gratuites

  • NVIDIA sert des modèles ouverts gratuitement via une API compatible OpenAI sur integrate.api.nvidia.com/v1, authentifiée par une clé créée sur build.nvidia.com. OpenClaw règle ce fournisseur par défaut sur Nemotron 3 Ultra, un modèle de raisonnement de 550 milliards de paramètres au total et 55 milliards actifs, dont la fiche intégrée déclare un contexte de 1 048 576 jetons et un budget de sortie de 8 192 jetons. Les coûts valent 0 par défaut dans le code, puisque NVIDIA offre actuellement un accès API gratuit aux modèles listés.
  • OpenRouter publie un catalogue public de modèles portant le suffixe :free, et OpenClaw le lit directement. La commande openclaw models scan classe les candidats et peut en promouvoir un comme modèle par défaut ou comme modèle d’images. Le catalogue étant public, une analyse limitée aux métadonnées avec --no-probe ne demande aucune identification, mais un modèle :free exige toujours OPENROUTER_API_KEY pour les sondes en direct et pour l’inférence réelle.
  • Les moteurs locaux sont la seule option vraiment hors compteur. Ollama, LM Studio et llama.cpp sont fournis comme greffons de fournisseur, un serveur Ollama local ne demande aucune authentification, et OpenClaw enregistre chaque coût de modèle Ollama à 0, aussi bien pour les modèles découverts automatiquement que définis à la main. Une règle compte plus que les autres : pointez OpenClaw vers l’URL native sur le port 11434 sans suffixe /v1, car le chemin compatible OpenAI casse l’appel d’outils et les modèles se mettent à émettre du JSON d’appel d’outil brut en texte clair.
  • Les paliers gratuits hébergés se situent entre les deux. Une clé Google AI Studio est gratuite à créer et ouvre le catalogue Gemini, y compris les niveaux Flash, et Hugging Face Inference place un seul jeton devant de nombreux modèles hébergés, avec une tarification qui suit les tarifs des fournisseurs et comprend un palier gratuit. Ce sont des arrangements de facturation plutôt que des points de terminaison gratuits, et ils peuvent donc bouger sans vous prévenir.
Pour les agents dotés d’outils ou les entrées non fiables, évitez les paliers de modèles anciens ou plus faibles.

L’appel d’outils casse en premier

Un agent OpenClaw n’est pas une fenêtre de discussion. Chaque tour peut lire un fichier, lancer l’outil exec, piloter un navigateur ou répondre sur un canal : un modèle incapable d’émettre un appel d’outil propre cesse d’être utile bien avant que sa prose ne se dégrade. Cet ordre de priorité est inscrit dans l’outillage : models scan classe les résultats par prise en charge des images, puis latence des outils, puis taille du contexte, puis nombre de paramètres, et --set-default comme --set-image refusent de modifier votre configuration à partir d’une analyse limitée aux métadonnées. La même prudence traverse les pages fournisseurs. L’inventaire de NVIDIA contient aussi des embeddings et d’autres points de terminaison non conversationnels, donc OpenClaw ne propose que les modèles disposant de métadonnées de discussion intégrées ou de métadonnées vedettes valides, et la documentation dit clairement que la seule présence dans une liste ne prouve pas la compatibilité. Les alias et les entrées de politique ne prouvent pas non plus qu’un modèle fonctionne sur le point de terminaison d’un fournisseur. Sondez d’abord, promouvez ensuite.

Lisez la colonne des prix avec méfiance

  • Chutes lit ses prix de jetons dans le catalogue natif de Chutes, et la référence est explicite : des métadonnées de prix indisponibles ou invalides n’établissent pas qu’un modèle est gratuit. Un prix vide est un trou dans le flux, pas une remise.
  • DeepInfra remplit un barème manquant ou non pris en charge avec un espace réservé à coût nul qui signifie inconnu, et non facturation gratuite vérifiée. Venice se comporte de la même façon pour les modèles inconnus sans tarification valide, tandis qu’un taux nul renvoyé explicitement par son API est réel et traité comme tel.
  • OpenCode Zen prévient que les modèles gratuits peuvent être des programmes de retour d’expérience temporaires, et que la facturation, la conservation et les politiques d’entraînement se décident modèle par modèle. Une route qui ne coûte rien ce mois-ci peut être retarifée sans nouvelle version d’OpenClaw, car le catalogue de modèles hébergé se rafraîchit à son propre rythme.

Rien de tout cela ne vous laisse deviner seul, et la référence est organisée par tâche plutôt que par vendeur. Deux pièces répondent à la plupart des questions sur les modèles gratuits : la référence des fournisseurs intégrés vous donne l’identifiant du fournisseur, la variable d’environnement d’authentification et un exemple de référence de modèle pour chaque greffon intégré, de quoi distinguer en une ligne un point de terminaison gratuit d’un proxy, tandis que les règles de sélection de modèle explique comment une référence fournisseur/modèle se résout, ce que fait la liste d’autorisation de remplacement dès que vous la définissez, et pourquoi un modèle local exige sa référence préfixée complète plutôt qu’un simple nom de fichier.

Partez du principe que le modèle gratuit sera indisponible

Les points de terminaison gratuits sont limités en débit, et la documentation décrit la réponse comme deux étapes, atteintes après une tentative bornée de récupération sur le même modèle. Cette première tentative couvre une limite temporaire et conserve la transcription et le travail déjà fait. Les deux étapes proprement dites sont la rotation des profils d’authentification à l’intérieur du même fournisseur, puis le repli de modèle vers l’entrée suivante de la liste configurée. La rotation est plus large que les seules limites de débit : un profil peut être dépassé sur des échecs d’authentification, des limites de débit, des limites de facturation ou des délais dépassés, et une erreur serveur du fournisseur ou une panne de transport reste éligible au repli. Une asymétrie mérite d’être connue avant de vous y fier, car un modèle que vous avez choisi vous-même dans une session est strict et échoue visiblement au lieu de répondre discrètement depuis un autre modèle. le basculement de modèle dans OpenClaw déroule toute la chaîne, et faire tourner OpenClaw sur des modèles locaux est la bonne lecture si votre réponse aux limites de débit consiste à ne plus dépendre du point de terminaison d’autrui.

Sur Diali

Diali héberge OpenClaw comme un runtime géré, un assistant par client, sans rien de mutualisé entre les comptes. Ce que vous choisissez dans le tableau de bord est compilé dans la configuration d’exécution et réécrit à chaque version, si bien que vos clés de fournisseur, votre modèle principal et votre ordre de repli appartiennent à l’agent plutôt qu’à un fichier que vous entretenez à la main. Les sessions, la mémoire et l’espace de travail vivent sur un volume persistant, ce qui rend réversible le fait d’essayer un modèle gratuit puis de l’abandonner ; des instantanés quotidiens et une restauration en un clic sont disponibles grâce à l’option Sauvegardes (incluse avec Max). OpenClaw hébergé sur Diali décrit ce que contient le runtime hébergé, et Tarifs Diali liste les formules.

  • Accès API gratuit, palier gratuit et matériel personnel sont trois paris différents.
  • Un zéro dans la colonne des prix signifie inconnu tant que le fournisseur ne documente rien.
  • Sondez l’appel d’outils d’un modèle gratuit avant d’en faire votre modèle principal.
Commencer

Arrêtez de lire, construisez le vôtre

Configurez un agent, choisissez un canal, et faites-le travailler dans l’application que vous gardez déjà ouverte.