ToolNavs 유용한 AI 도구 찾기
도구 제출 로그인
돌아가기 AI 정보
GPT-6.1 Sol 출시, Astra급 지능을 5분의 1 가격에

GPT-6.1 Sol 출시, Astra급 지능을 5분의 1 가격에

AI 정보 • Admin • • 9 회 조회

9월 29일, OpenAI는 DevDay 2026에서 GPT-6.1 Sol을 발표했다. GPT-6 Sol의 업그레이드 버전으로, 에이전트형 코딩, computer use, 전문 업무 워크로드에서의 지능은 GPT-6 Astra에 근접하면서 표준 입력·출력 토큰 가격은 Astra의 5분의 1이라고 한다.

이번 발표의 핵심은 가격이다. API 표준 가격은 입력 100만 토큰당 2달러, 출력 10달러이며, 캐시 입력은 단 0.10달러로 표준 입력보다 95% 저렴하고 GPT-6 Sol의 캐시 입력보다 절반 수준이다. OpenAI에 따르면 이를 통해 "요청을 넘나들며 컨텍스트를 재사용하는" 에이전트를 구축·운영할 여지가 크게 넓어진다. 제공 범위는 9월 29일부터 ChatGPT Work와 Codex의 Plus, Pro, Business, Enterprise, Edu 사용자이며, API에서는 gpt-6.1-sol로 이용할 수 있다. 일반 Chat 대화에는 아직 미적용이다. 며칠 내 GPT-6.1 Sol Ultrafast도 출시되어 Codex 내 토큰 생성 속도가 최대 8배 빨라진다.

벤치마크: Astra를 따라잡은 영역

  • DeepSWE v1.1(실제 코드베이스의 장기 소프트웨어 공학 태스크): Astra와 동등한 성능을 약 5분의 1 비용으로 달성. GPT-6 Sol 최고 기록을 6.4%포인트 웃돌았고 추론 부담도 낮다.
  • GDP.pdf(표·차트·세부 조항이 담긴 복잡한 PDF로 전문 질문에 답변): 폴백 적용 Opus 5.5를 상회, 태스크당 비용은 절반 이하. Astra의 최고 수준에 근접하면서 비용은 약 5분의 1.
  • AutomationBench(47개 도구, 영업·마케팅·운영 부서를 아우르는 다단계 업무 흐름): 중간 추론 설정에서 Opus 5.5보다 2.2%포인트 높고 비용은 약 3분의 1. GPT-6 Sol 대비 4.8%포인트 향상.
  • OSWorld 2.0 오프라인 세트(장기 computer-use 워크플로): GPT-6 Sol보다 7%포인트 높다. 최대 추론 설정에서 Astra와의 격차는 2.1%포인트, 태스크당 비용은 약 7분의 1.
  • Terminal-Bench Science 0.1(데이터 분석·시뮬레이션·정리 증명 등 과학 워크플로): GPT-6 Sol의 2배가 넘는 점수. 태스크 평균 비용 5.47달러로, Opus 5.5의 23.21달러, Astra의 23.80달러를 크게 밑돈다.

정확성과 안전성: 오류는 줄고, 말도 잘 듣는다

정확성 평가에서 낮은 추론 설정 기준 사실 오류를 포함한 답변 비율이 11.4%에서 7.7%로 감소(약 32%↓). 전 구간에서 Astra와의 격차는 1.9%포인트 이내다. 정렬 평가에서는 "검색 도구 고장 여부 고지", "명시적 제한 준수", "에이전트 태스크에서 권한 밖 결과 회피" 같은 난제에서 실패율이 GPT-6 Sol보다 낮았다. 자동 안전 심사 우회 시도는 관찰되지 않아 Astra 및 GPT-6 Sol과 동등하다고 한다.

의미: Astra가 멈춘 사이, Sol이 현실적인 선택지로

며칠 전 OpenAI는 다음 달 예정이던 GPT-6.1 Astra 출시를 안전 정렬 테스트 기준 미달을 이유로 취소했다. Astra가 "극한의 지능"이라면 Sol은 "쓸 만한 지능을 쓸 수 있는 가격에"다. 개발자에게 이번 발표의 진짜 신호는 장기 에이전트 태스크의 비용 구조가 바뀌었다는 점이다. 캐시 입력 100만 토큰당 0.10달러는 "코드베이스 전체를 에이전트에 장기 투입하는 일"을 사치에서 일상 운영으로 바꾼다. 대가도 명확하다. 여전히 Astra는 아니다. Terminal-Bench Science의 68.1%는 Astra가 보유한 최고 기록이며, 가장 어려운 과학 연구에는 OpenAI도 Astra를 권장한다.

추천 도구

더보기