ToolNavs 유용한 AI 도구 찾기
도구 제출 로그인
돌아가기 AI 정보
Claude Opus 5.5, Text Arena 1위 등극…1509점으로 텍스트 모델 신기록

Claude Opus 5.5, Text Arena 1위 등극…1509점으로 텍스트 모델 신기록

AI 정보 • Admin • • 5 회 조회

Claude Opus 5.5, Text Arena 1위 등극…1509점으로 텍스트 모델 신기록 Claude Opus 5.5가 출시된 지 나흘 만에 텍스트 모델 아레나의 정상에 올랐다. 9월 26일 LMArena 공식 계정이 X에 최신 순위를 발표했다. Claude Opus 5.5(High)가 1509점으로 Text Arena 1위에 데뷔하며 해당 순위표 사상 최고 점수를 기록했다.

Text Arena는 LMArena의 텍스트 모델 부문 순위로, 전 세계 사용자의 익명 맞대결 투표로 정해진다. 수학, 코딩, 창작 등 여러 영역을 아우른다. 일회성 정적 벤치마크와 달리 '실제로 써보면 뭐가 더 강하게 느껴지는지'에 가깝다. 1509점(오차 약 ±12)은 종전 1위를 뛰어넘는 점수로, 9월 22일 정식 출시 이후 단 나흘 만의 기록이다.

값이 싸진 모델이 왕좌를 차지했다

이번 1위의 묘미는 가격에 있다. Opus 5.5의 API 가격은 100만 토큰당 입력 4달러, 출력 20달러로, 성능은 플래그십 Fable 5.1에 근접하고 100만 토큰 컨텍스트 윈도우와 최대 12만 8천 토큰의 1회 출력을 갖췄다. 반면 OpenAI의 플래그십 GPT-6 Astra는 10달러/50달러다. 즉 순위표 1위 모델이 동시에 프런티어에서 가장 저렴한 축에 속하는 셈이다. '최강'과 '최저가'가 겹치는 일은 드물고, 이번은 예외다. (출시 당시 가격·사양 전체는 이전 Claude Opus 5.5 출시 분석 참고.)

순위가 말해주는 것, 말해주지 않는 것

다만 이 1위는 차분히 받아들일 필요가 있다. Text Arena는 본질적으로 인간 선호 투표다. 종합적인 사용 체감을 반영할 뿐 특정 능력의 엄밀한 지표는 아니며, 투표가 쌓이면 점수는 계속 출렁이고 1위도 바뀔 수 있다. 일반 사용자에게 실질적인 의미는 모델 선택의 참고 자료라는 점이다. 장시간 코딩이나 에이전트 용도로 모델을 고른다면, Opus 5.5는 '사용자 투표 1위'와 '최저가급 플래그십'이라는 간판을 동시에 달고 있어 시도 비용이 그 어느 때보다 낮다. 그렇다고 '모든 작업에서 최강'이라는 뜻은 아니다. 터미널 에이전트나 수학 추론 같은 전문 벤치마크에서는 경쟁 모델이 여전히 바짝 추격 중이다. 순위는 바뀌겠지만, 가격 전쟁은 당분간 멈추지 않을 것이다.

추천 도구

더보기