Zurück zu Fragen und Antworten zu KI
Was soll ich tun, wenn der Verbrauch des Hermes-Agenten-Tokens hoch ist?

Was soll ich tun, wenn der Verbrauch des Hermes-Agenten-Tokens hoch ist?

Fragen und Antworten zu KI Admin 335 Aufrufe

Der Verbrauch von Hermes-Agenten-Token ist plötzlich hoch, also gib dem Modell nicht die Schuld, dass es teuer ist. In letzter Zeit hat sich dieses Problem stark auf die Community konzentriert, und die häufigen Auslöser sind: zu viele Tool-Aufrufe, zu lange Kontexte, hybride Speicherabrufe und kein billiges Modell-Routing. Bei der Recherche ist es notwendig, zunächst herauszufinden, welche Sorte brennt.

Schnellste Ermittlungssequenz

  1. Verwenden Sie /usage, um zuerst den ungefähren Konsumtrend zu erkennen.
  2. Führe /compress zuerst lange Gespräche durch, und häufe den Kontext nicht unendlich an.
  3. Wenn du den Honcho-Hybridspeicher einschaltest, schalte den lokalen Speicher vorübergehend zum Vergleich ab.
  4. Wenn es viele einfache Fragen und Antworten gibt, sollten Sie smart_model_routing aktivieren.
  5. Repariere das Werkzeug, falls es wiederholt ausfällt, und lass den Agent nicht immer wieder versuchen.

Das Kostenproblem sollte auseinandergenommen werden: Modellpreis ist Teil davon, und fehlgeschlagene Wiederholungen sowie lange Kontexte sind die am leichtesten zu ignorierenden unsichtbaren Rechnungen.

Kurz gesagt: Schau dir zuerst /usage und Kontext an, dann sieh dir Honcho und das Tool an, um es erneut zu versuchen, und ändere schließlich das Modell.

Offizielle Open-Source-Adresse: https://github.com/NousResearch/hermes-agent; Offizieller Dokumenteneintrag: https://hermes-agent.nousresearch.com/.

Empfohlene Tools

Mehr