Hermesエージェントトークンの消費が急に高くなったので、モデルが高価だと責めないでください。 最近、この問題はコミュニティに非常に集中しており、よくあるトリガーはツール呼び出しの多さ、コンテキストが長すぎる、ハイブリッドメモリの情報取得、そして安価なモデルルーティングの欠如です。 調査する際は、まずどのタイプが燃えているのかを特定する必要があります。
最速調査手順
- まず
/usageを使っておおよその消費傾向を確認してください。 - 長い会話にはまず
/compress実行し、文脈を無限に積み重ねないようにしましょう。 - Honchoのハイブリッドメモリをオンにする場合は、比較のためにローカルメモリを一時的にカットします。
- 簡単な質問や回答が多い場合は、
smart_model_routingをオンにすることを検討してください。 - 繰り返し失敗したら修理し、エージェントに何度も試みさせないようにしましょう。
コストの問題は分解されるべきです。モデル価格もその一部であり、失敗した再試行や長いコンテキストが最も無視されやすい不可視の請求書です。
一言で言えば、まずは /usage とコンテキストを見てから、Honcho とツールで再度試し、最後にモデルを変更することです。
公式オープンソースアドレス:https://github.com/NousResearch/hermes-agent; 公式文書登録:https://hermes-agent.nousresearch.com/。