Le modèle maître Hermes Agent utilise un modèle local, ce qui ne signifie pas que toutes les tâches sont hors ligne. La documentation officielle des fournisseurs de secours est clairement écrite : vision, web extract, compression, session_search, skills_hub, MCP et mémoire flush ont toutes des chaînes d’analyse de auxiliary différentes des fournisseurs. Cela signifie que des tâches de contournement telles que la compression, l’organisation de la mémoire et l’extraction de pages web peuvent toujours passer par OpenRouter ou d’autres fournisseurs cloud.
Comment vérifier s’il ajuste les nuages
- Voyez quel type de tâche a déclenché la requête dans le journal : compression, flush_memories, web_extract ou vision.
- Vérifiez si
auxiliary.*.providerest toujoursauto. - Vérifiez que
compression.summary_providerprécise un modèle cloud. - Changez explicitement la tâche secondaire critique pour
mainou personnalisez le terminaison local et testez à nouveau.
Si vous voulez être strictement hors ligne, vous ne pouvez pas simplement changer la model.provider de niveau supérieur, mais aussi fermer les tâches auxiliaires ensemble. Sinon, la conversation principale est localisée, et les résumés en arrière-plan ainsi que les rafraîchissements de mémoire peuvent rester flous.
En un mot : lors du déploiement d’Hermes Agent hors ligne, vous devez vérifier simultanément les configurations modèle, auxiliaire et compression.
Adresse officielle open source : https://github.com/NousResearch/hermes-agent ; Entrée officielle du document : https://hermes-agent.nousresearch.com/.