ToolNavs 유용한 AI 도구 찾기
도구 제출 로그인
돌아가기 AI 정보
Anthropic, 반년 만에 CI 부하가 25배 증가했다고 밝혔습니다: 에이전트 코딩이 테스트 병목 현상을 가장 먼저 돌파했다

Anthropic, 반년 만에 CI 부하가 25배 증가했다고 밝혔습니다: 에이전트 코딩이 테스트 병목 현상을 가장 먼저 돌파했다

AI 정보 Admin 13 회 조회

2026년 9월 14일, Anthropic은 Claude의 공식 블로그를 통해 내부 지속적 통합(CI) 시스템의 확장 경험을 공개했습니다: Claude가 약 80%의 코드를 작성하는 데 참여하면서, 엔지니어링 팀은 2021-2025년 대비 분기당 평균 8배의 코드를 제출했고, 테스트 수는 10배 증가했으며, CI 작업은 단 6개월 만에 20-fiffold로 증가했습니다. 이 사례는 코딩 에이전트를 배포하는 팀들에게 상기시켜 줍니다: 개발 속도가 증가한 후 가장 먼저 압박을 받는 것은 모델이나 편집자가 아니라 테스트 선택, 큐, 상태 저장소일 수 있습니다.

왜 일시적 확장은 이렇게 빨리 실패할까요?

Anthropic은 더 큰 기계로 전환하고, 패키지별로 샤딩하며, 프로세스 실패 시 자동으로 재시작하는 시도를 시도했습니다. 대형 기계는 약 70일 정도만 더 버텼고, 샤딩은 약 29일 후에 다시 정점을 찍었으며, 재시작은 하루도 채 되지 않아 효과가 떨어졌습니다. 그 이유는 기존 시스템이 테스트 이력을 단일 프로세스 내에 저장했기 때문입니다: 리스너는 결과를 받고 코드 변경과 관련된 테스트를 계산했습니다. 작업 부하가 급격히 증가하면서 계산, 메모리, 상태 복구가 서로 제약을 맺었고, 롤링 배포나 크래시가 발생하면 적체가 증가했습니다.

재건의 초점은 단순히 기계를 계속 쌓는 것만이 아닙니다

팀은 아키텍처를 상태 없는 리스너, 메모리 데이터 저장소, 로그 소비 프로세스로 나누었습니다. 리스너는 수평적으로 확장할 수 있으며, 테스트 결과만 기록할 수 있습니다; 독립적인 소비자는 이벤트를 테스트 유지보수 이력으로 조직하고, 셀렉터는 과거 히트와 패키지 상관관계를 바탕으로 어떤 테스트를 실행할지 결정합니다. Anthropic은 전환 후에도 새 시스템이 안정적으로 유지되었으며, 한 엔지니어가 Claude를 사용해 약 3주 만에 거의 4분의 1에 달했던 작업을 완료했다고 밝혔습니다.

코딩 에이전트를 도입하는 팀에 어떤 의미가 있나요?

  • 극단적인 성장을 위해 설계된 것: Anthropic은 인프라 리더들이 두 분기 동안 25배의 부하 증가를 예상할 것을 권장하지만, 이는 자체 사업에서 나온 것이므로 기계적으로 통합된 산업 예측으로 적용해서는 안 된다.
  • 상태 및 계산 분리: 키 히스토리를 프로세스 외부에 남겨두면 워커 노드 확장이나 재시작 시 문맥 손실을 방지할 수 있습니다.
  • 먼저 입력과 출력을 모니터링하세요: 테스트 이벤트에 20분 지연이 있으면 수만 건의 업데이트를 놓칠 수 있습니다; 큐 지연, 선택 히트율, 중복 실행 수 등이 핵심 지표가 되어야 합니다.
  • 재계산 절감: 에이전트는 코드를 더 빠르게 생성하지만 테스트, 캐싱, 해시 비용이 증가하여 개발 결과물에만 집중하면 순수익을 과대평가할 수 있습니다.

시행 전에 용량 훈련을 실시하세요

기업들은 CI가 완전히 혼잡해질 때까지 기다릴 필요가 없습니다. 먼저 각 병합에 의해 트리거되는 테스트 수, 피크 큐 시간, 과거 상태 복구 시간, 변경 당 비용을 세고, 5배, 10배, 25배 동시성을 시뮬레이션할 수 있습니다. 시스템이 여전히 단일 노드 메모리나 수동 재부팅에 의존한다면, 관측 및 상태 계층 수정에 우선순위를 두어야 합니다. Anthropic의 수치가 모든 팀이 같은 곡선을 맞이한다는 것을 증명하지는 않지만, 코딩 에이전트의 조달 계획과 소프트웨어 제공 인프라 예산을 함께 검토해야 한다는 명확한 신호를 보냅니다.

추천 도구

더보기