지난 24시간 AI 업계는 두 건의 동시 발표가 장악했습니다. OpenAI와 Anthropic이 같은 날 신모델을 출시하고 같은 날 가격을 인하하면서 가격 전쟁이 본격화됐고, 한편 Meta의 고권한 어시스턴트에서는 보안 문제가 터졌습니다. 빠르게 훑어볼 8가지 소식입니다.
OpenAI, GPT-6 Sol·Luna 출시… API 가격 절반으로
9월 22일 OpenAI는 공식 블로그를 통해 GPT-6 패밀리의 신모델 2종을 발표했습니다. 복잡한 코딩과 에이전트 워크플로용 GPT-6 Sol은 100만 토큰당 입력 2달러·출력 10달러, 경량 모델인 GPT-6 Luna는 입력 0.10달러·출력 0.50달러로 GPT-5.6 프로모션 가격의 절반입니다. 두 모델 모두 ChatGPT Work, Codex, API에서 제공되며, Luna는 Free·Go 사용자도 데스크톱 앱에서 쓸 수 있습니다.
핵심은 에이전트 운영의 토큰 요금이 눈에 띄게 줄어든다는 점입니다. Sol은 고빈도 호출, Luna는 문서 요약·정보 추출처럼 '양은 많지만 단순한' 작업에 적합합니다. Anthropic도 같은 날 인하에 나서면서 개발자에게는 오랜만의 바이어스 마켓이 열렸습니다.
Anthropic도 같은 날 Claude Opus 5.5 출시, 비용 40%↓
Anthropic은 9월 22일 공식 발표를 통해 Claude 5.5 시리즈의 첫 모델인 Opus 5.5를 내놨습니다. Opus 5 대비 일반 워크로드 비용이 40% 감소했고, 입출력은 100만 토큰당 4달러·20달러, 출력 속도는 30% 이상 빨라졌습니다. Terminal-Bench 4.0 등 에이전트 코딩·지식 노동 벤치마크에서 선두를 차지했고 Artificial Analysis Intelligence Index에서도 1위에 올랐습니다. Claude Code도 같은 날 v2.1.280을 배포하며 기본 Opus 모델을 5.5로 전환했습니다.
두 거대 기업이 같은 날 출시·인하에 나선 것은 우연이 아닙니다. 프론티어 모델 경쟁은 '누가 더 똑똑한가'에서 '누가 더 싸고 빠른가'로 이동하고 있습니다. 사용자에게 돌아오는 직접 혜택은 Pro·Max 등 구독 플랜의 5시간 사용량 상한이 함께 올라간다는 점입니다.
OpenAI, GPT-6용 프롬프트 캐싱 업그레이드… 캐시 읽기 최대 90% 할인
같은 9월 22일 OpenAI는 GPT-6용으로 개선된 프롬프트 캐싱 시스템과 진단 도구를 발표했습니다. 캐시 적중률 향상, 응답 속도 개선과 함께 캐시된 입력 토큰 읽기에 90% 할인이 적용됩니다. 이번 인하와 맞물려 긴 대화·반복 호출이 많은 에이전트 워크플로 비용이 한층 낮아집니다. 개발자라면 콘솔의 새 캐싱 진단 대시보드에서 자신의 호출 패턴이 할인을 제대로 먹고 있는지 확인할 만합니다.
Qwen, 음성 모델 Qwen-Audio-3.1 풀 라인업 발표… 대폭 인하
9월 23일 Qwen은 Qwen-Audio-3.1 시리즈를 공식 발표했습니다. ASR·TTS·Realtime 전면 업그레이드에 TTS-Next, ASR-Next 두 모델이 새로 추가됐습니다. 전 라인 가격 인하로 TTS 약 70%, Realtime 약 85%, ASR 최대 95% 인하됩니다. 음성 API 가격 전쟁도 치열합니다. 본 사이트 AI 뉴스 채널에서 오늘 상세히 다룬 바 있어 여기서는 생략합니다.
Qwen-Image-2.1, 알리바바 자체 AI Arena 오픈소스 부문 1위
9월 23일 Qwen은 Qwen-Image-2.1이 자사 평가 플랫폼 AI Arena에서 이미지 편집·텍스트 투 이미지 오픈소스 부문 1위를 차지했다고 발표했습니다. 자사 운영 순위라는 점은 감안해야 하며, 독립적인 제3자 평가는 아직 적어 실력 판단은 블라인드 테스트 데이터가 쌓이길 기다리는 게 현명합니다. 다만 중국산 오픈소스 이미지 모델이 공개 순위를 빠르게 오르고 있는 것은 분명합니다.
Meta Muse에서 제로데이 발견… 핫픽스 배포 완료
9월 22일 Ars Technica가 최초 보도했습니다. macOS 보안 연구원 Patrick Wardle이 Meta의 신형 AI 어시스턴트 Muse에서 제로데이를 발견했습니다. 특별한 권한 없이 임의의 로컬 앱이 Muse의 비공개 설정을 바꿔 음성 입력 전사 엔드포인트를 공격자 서버로 돌리고 Muse 계정 전체를 탈취할 수 있다는 것입니다. Wardle의 PoC에서는 경고 없이 파일을 쓰고 카메라를 켜는 장면이 시연됐습니다. Meta는 핫픽스를 배포했고 원격 공격이 아닌 로컬 권한 상승이라고 강조했습니다. 같은 날 Amazon도 Muse의 Amazon.com 대리 구매 중단을 Meta에 요청했음을 확인했습니다.
주목할 점은 취약점 자체보다 아키텍처입니다. 온갖 권한을 요구하는 개인용 에이전트는 설계에 약점이 있으면 일반 앱보다 훨씬 위험해집니다. Meta가 내세운 '시큐어 VM' 간판이 출시 직후부터 혹독한 시험대에 올랐습니다.
미 국방부 조사 "Palantir Maven AI 과신이 학교 오폭 원인 중 하나"
9월 22일 Gizmodo가 Bloomberg 조사 보도를 인용해 전했습니다. 국방부 내부 조사에서 낡은 첩보·오래된 위성 사진에 더해 미 중부사령부 인력이 Palantir의 Maven Smart System에 과도하게 의존한 것이 2월 28일 이란 미나브 학교 오폭(어린이 123명 사망)의 원인 중 하나로 지목됐습니다. 일부 운용 요원은 시스템이 만료·모순된 첩보를 자동으로 걸러줄 것으로 오해했다고 합니다. Palantir는 기초 데이터에 책임이 없으며 소프트웨어 과실을 보여주는 증거가 없다고 답했습니다.
AI 지원 의사결정이 이처럼 참혹한 형태로 군사적 책임 추궁의 대상이 된 것은 처음입니다. 문제는 모델이 멍청했다는 게 아니라, 사람이 직접 했어야 할 검증을 시스템에 떠넘겼다는 데 있습니다.
OpenRouter, 2026년 베스트 임베딩 모델 선정 가이드 공개
9월 23일 OpenRouter는 공식 블로그에 2026년 베스트 임베딩 모델 선정 가이드를 공개했습니다. 37개 디렉터리 항목을 수록했습니다. RAG나 시맨틱 검색 모델 선정을 앞둔 팀이라면 문서를 일일이 뒤지는 대신 치트시트로 활용하면 됩니다.