Hermes 에이전트 토큰 소비가 갑자기 높아졌으니, 모델이 비싸다고 탓하지 마세요. 최근 이 문제는 커뮤니티 내에서 매우 집중되어 있으며, 일반적인 트리거는 너무 많은 툴 호출, 너무 긴 컨텍스트, 하이브리드 메모리 정보 가져오기, 저렴한 모델 라우팅 부재 등이 있습니다. 조사할 때는 먼저 어떤 유형이 불타고 있는지 파악하는 것이 필요합니다.
가장 빠른 수사 순서
- 먼저 대략적인 소비 추세를 보기 위해
/usage을 사용하세요. - 긴 대화를 위해 먼저
/compress을 실행하세요, 무한히 맥락을 쌓지 마세요. - Honcho 하이브리드 메모리를 켜면 비교를 위해 로컬 메모리를 일시적으로 차단하세요.
- 간단한 질문과 답변이 많을 때는
smart_model_routing을 켜보는 것을 고려해 보세요. - 도구가 반복적으로 실패하면 고치고, 에이전트가 계속 시도하지 못하게 하세요.
비용 문제는 분해되어야 합니다: 모델 가격도 그 일부이고, 실패한 재시도와 긴 컨텍스트는 가장 쉽게 무시되는 보이지 않는 청구서입니다.
한마디로: 먼저 /usage와 context를 보고, Honcho와 도구를 확인해 다시 시도하고, 마지막으로 모델을 변경하세요.
공식 오픈 소스 주소: https://github.com/NousResearch/hermes-agent; 공식 문서 입력: https://hermes-agent.nousresearch.com/.