Der Verbrauch von Hermes-Agenten-Token ist plötzlich hoch, also gib dem Modell nicht die Schuld, dass es teuer ist. In letzter Zeit hat sich dieses Problem stark auf die Community konzentriert, und die häufigen Auslöser sind: zu viele Tool-Aufrufe, zu lange Kontexte, hybride Speicherabrufe und kein billiges Modell-Routing. Bei der Recherche ist es notwendig, zunächst herauszufinden, welche Sorte brennt.
Schnellste Ermittlungssequenz
- Verwenden Sie
/usage, um zuerst den ungefähren Konsumtrend zu erkennen. - Führe
/compresszuerst lange Gespräche durch, und häufe den Kontext nicht unendlich an. - Wenn du den Honcho-Hybridspeicher einschaltest, schalte den lokalen Speicher vorübergehend zum Vergleich ab.
- Wenn es viele einfache Fragen und Antworten gibt, sollten Sie
smart_model_routingaktivieren. - Repariere das Werkzeug, falls es wiederholt ausfällt, und lass den Agent nicht immer wieder versuchen.
Das Kostenproblem sollte auseinandergenommen werden: Modellpreis ist Teil davon, und fehlgeschlagene Wiederholungen sowie lange Kontexte sind die am leichtesten zu ignorierenden unsichtbaren Rechnungen.
Kurz gesagt: Schau dir zuerst /usage und Kontext an, dann sieh dir Honcho und das Tool an, um es erneut zu versuchen, und ändere schließlich das Modell.
Offizielle Open-Source-Adresse: https://github.com/NousResearch/hermes-agent; Offizieller Dokumenteneintrag: https://hermes-agent.nousresearch.com/.