L’agent Hermès tourne lentement, alors ne vous précipitez pas pour changer la machine tout de suite. Les vraies raisons se répartissent généralement en trois catégories : la lenteur de la réponse du modèle, l’exécution lente de l’outil et un contexte trop long. Lors du dépannage, examinez d’abord le fournisseur, les jetons d’entrée/sortie, le temps de l’outil et les tentatives d’erreur dans les journaux, puis décidez si vous changez le modèle, réduisez le contexte ou diminuez l’outil.
Position dans cet ordre
- Regardez la latence du modèle : si un appel API prend des dizaines de secondes, priorisez le changement de fournisseur ou de modèle.
- Regardez la longueur d’entrée : si le jeton d’entrée est très élevé, vérifiez s’il y a trop de fichiers, de sessions historiques ou de ressources MCP.
- Regardez la chaîne d’outils : navigateurs, web scraping, SSH distant, la construction Docker est naturellement plus lente que le chat pur.
- Regardez la réévaluation : 429, 402, délai d’attente et échec d’authentification allongeront le temps total.
Comment accélérer les choses
Ne recourez pas par défaut au modèle le plus puissant pour les tâches simples. Le résumé, la compression et la classification peuvent être confiés à des modèles bon marché ou des modèles auxiliaires ; modification du code, jugement d’architecture, puis retour au modèle principal. Utiliser /model pour changer en cours de route est plus économique que de partir avec une configuration haute tout au long du processus. Pour les longues tâches de données, laissez d’abord l’agent Hermès lister les plans, ne lisez que les documents nécessaires, et ne lisez pas tout le dépôt d’un coup.
Quand n’est pas la question d’Hermès
Si OpenRouter, Nous Portal ou un point de terminaison construit lui-même est lent à répondre, l’agent Hermes ne peut qu’attendre. Vous pouvez changer de fournisseur, activer le plan de secours, ou passer à un modèle plus rapide pour des tâches secondaires. Si c’est la version Docker, la suite de tests et le chargement de pages web qui sont lents, optimisez les commandes et le réseau, pas seulement le modèle.
Jugement pratique : la période de questions-réponses pure est lente, principalement modèle/fournisseur ; Lecture lente des fichiers, principalement du contexte et des outils ; S’il n’y a pas de sortie pendant longtemps, la plupart du temps il faut consulter les journaux et les notifications de tâches en arrière-plan.
Adresse officielle open source : https://github.com/NousResearch/hermes-agent ; Entrée officielle du document : https://hermes-agent.nousresearch.com/.