OpenClaw dit que la requête au modèle a expiré
Modèles locaux à froid, limites des fournisseurs, et les quatre autres causes habituelles
Une requête au modèle qui expire est l’une des premières erreurs que rencontrent les gens après avoir basculé OpenClaw sur un modèle local, et les pages de dépannage de la documentation lui donnent une courte liste de causes. La plupart concernent le moteur local : un grand modèle qui se charge à froid, une fenêtre de contexte que le matériel ne peut pas porter, un hôte qui répond à curl mais pas à la passerelle. Deux concernent les fournisseurs hébergés, une limite de débit déguisée en 429 et un blocage en amont déguisé en 403. Voici chacune avec son correctif, dans l’ordre où la documentation suggère de les essayer.
Les causes locales
- Un modèle à froid : les grands modèles locaux peuvent avoir besoin d’un long premier chargement. Réservez un délai plus long au fournisseur Ollama, l’exemple de la documentation étant 300 secondes, et gardez le modèle chargé entre les tours avec un paramètre de maintien sur l’entrée du modèle ; le même réglage allonge aussi le délai de connexion quand l’hôte est lent à accepter les connexions.
- Une fenêtre de contexte trop grande : de nombreux modèles annoncent des contextes que le matériel ne peut pas faire tourner confortablement. Plafonnez à la fois le budget de jetons d’OpenClaw et le contexte de la requête sur l’entrée du modèle pour une latence prévisible du premier jeton.
- Un hôte qui marche avec curl mais pas avec OpenClaw : vérifiez depuis la machine et l’environnement qui font tourner la passerelle, parce qu’une URL de base qui dit localhost ne pointe nulle part depuis un conteneur Docker, l’URL peut porter le suffixe compatible OpenAI qui change le comportement, l’hôte distant peut exiger des changements de pare-feu ou de liaison, et le modèle peut être sur le démon du portable plutôt que sur le distant.
Les grands modèles locaux peuvent avoir besoin d’un long premier chargement.
Le moteur qui passe les sondes et échoue quand même
La page de dépannage des fournisseurs a un cas pour un moteur local compatible OpenAI qui répond aux petites requêtes directes et échoue quand même sur les exécutions d’agent : le transport est probablement correct et le moteur échoue sur la forme plus large de l’invite de l’environnement d’agent, Gemma sur certaines compilations de llama-server étant l’exemple de la documentation. Un message de tour incomplet sans charge utile signifie que le moteur a terminé la requête mais n’a renvoyé aucun texte visible ; OpenClaw réessaie un tel tour une fois. Si les échecs diminuent après désactivation des outils sans disparaître, les schémas d’outils faisaient partie de la pression et le reste tient à la capacité du moteur ou à un bug.
Les causes hébergées
- Un 429 disant qu’un usage supplémentaire est requis pour le contexte long : le modèle Anthropic sélectionné a une fenêtre native d’un million de jetons, ou une ancienne configuration porte encore l’indicateur hérité de contexte long, et l’identifiant n’y est pas éligible. Passez à une fenêtre standard, utilisez un identifiant éligible ou une clé d’API, et configurez des modèles de repli pour que les exécutions continuent.
- Un 403 générique disant que la requête a été bloquée : pas toujours un problème d’OpenClaw ; il peut venir d’un CDN, d’un WAF, d’une règle de gestion des bots ou d’un proxy inverse devant un point d’accès compatible OpenAI, vérifiez donc l’état, l’état de la passerelle et les journaux avant de changer la configuration.
- La mauvaise URL : le suffixe compatible OpenAI sur un hôte Ollama casse les appels d’outils et peut faire imprimer au modèle le JSON des outils comme du texte ; l’URL native, sans le suffixe, est le correctif.
OpenClaw avec Ollama a la page complète sur les modèles locaux, et OpenClaw ne répond pas est l’échelle quand le symptôme est le silence plutôt qu’une expiration.
Comment regarder
Chacune de ces causes commence par les trois mêmes commandes que la documentation répète : suivre les journaux, vérifier l’état des modèles, et lire la configuration des modèles. Les journaux d’OpenClaw explique où est le fichier et comment le suivre.
Sur Diali
Sur Diali, les modèles sont hébergés et les délais sont à nous à régler, si bien que la moitié locale de cette liste ne s’applique pas ; la moitié hébergée est prise en charge par le routage de repli avant qu’une réponse ne soit perdue. OpenClaw hébergé sur Diali est l’assistant.
- Modèle à froid : un délai de fournisseur plus long et un maintien.
- Trop de contexte : plafonnez le budget et le contexte de la requête.
- Un 429 ou un 403, c’est le fournisseur, pas la passerelle.
Arrêtez de lire, construisez le vôtre
Configurez un agent, choisissez un canal, et faites-le travailler dans l’application que vous gardez déjà ouverte.
