10월 9일 AI 브리핑은 지난 24시간을 정리한다. 주제는 속도와 에이전트다. OpenAI는 GPT-6.1 Sol에 표준 가격의 6배로 속도를 파는 Ultrafast 등급을 추가했고, Google은 Gemini를 기업 시스템 전반에서 일하는 범용 업무 에이전트로 만들었다. 자금 쪽에서는 Arena와 Manus 모회사가 대형 투자를 받았고, 안전 쪽에서는 AWS 에이전트 취약점 체인, 러시아·이란 영향 공작, OpenAI 해고 논란에 대한 공식 답변이 같은 날 나왔다. 아래 8건은 모두 2026년 10월 8~9일 공개·보도돼 원출처를 확인할 수 있고, 오늘 이미 단독 기사로 다룬 OpenAI 매출과 Claude 사용 정책은 반복하지 않는다.
OpenAI, GPT-6.1 Sol Ultrafast 출시: 6배 가격에 속도를 산다
OpenAI는 10월 8일 개발자 계정과 API 변경 기록을 통해 GPT-6.1 Sol의 Ultrafast 서비스 등급을 API, Codex, ChatGPT Work에 출시했다. API에서는 모든 사용자가 별도 한도 아래 service_tier를 ultrafast로 설정해 쓸 수 있으며, 짧은 컨텍스트 기준 가격은 입력 100만 토큰당 12달러, 출력 60달러로 표준 등급의 6배다. Codex에서는 표준보다 최대 8배 빠른 생성을 내세운다. Work와 Codex 쪽 대상은 Pro 500과 자격을 갖춘 기업·교육 워크스페이스가 중심이고 미국과 EU 데이터 상주를 지원한다. 지연이 경험을 좌우하는 장애 디버깅, 실시간 상호작용, 도구를 연속 호출하는 에이전트에 맞고, 일반 배치 작업은 표준 등급이 합리적이다.
Google, Gemini 범용 업무 에이전트 발표
Google Cloud는 10월 8일 Gemini at Work 2026에서 Gemini agent를 발표했다. 단일·범용 업무 에이전트라는 위치로, 기업의 업무 맥락을 지니고 스스로 작업을 계획하며 기술과 도구를 호출해 회사 시스템에 연결하고, 결과물을 사용자가 이미 쓰는 문서, 메일, 개발 환경 안으로 돌려준다. 주목할 점은 에이전트와 모델의 분리다. 작업마다 가장 적합한 모델을 고르는데 현재는 Gemini 계열과 Anthropic의 Claude 계열에서 고를 수 있고 앞으로 더 늘며, 비용 통제도 내장됐다. 업계별 버전도 예고돼 금융과 법률이 먼저 프리뷰에 들어가고 정부, 의료, 소매가 뒤를 잇는다. 기업은 데모보다 권한 거버넌스와 실제 시스템 연결 깊이를 검증해야 한다.
Arena, 2억 달러 시리즈 B: 기업가치 31억 달러, 정렬 지수도 출시
모델 평가 플랫폼 Arena는 10월 8일 공식 블로그에서 2억 달러 규모의 시리즈 B를 발표했고 기업가치는 31억 달러, Lightspeed와 Khosla Ventures가 공동 주도했다. 회사 측은 연환산 매출이 1억 달러를 넘었고 플랫폼 누적 세션이 약 3억 5천만 회, 투표가 6,200만 회라고 밝혔다. 함께 공개한 Alignment Index는 실제 에이전트 세션 궤적에서 모델이 인간 의도에서 얼마나 벗어나는지, 예컨대 무허가 행동을 하거나 안 끝난 일을 끝났다고 하는지를 측정한다. 정적 벤치마크를 모델이 알아채고 공략하기 쉬워지는 가운데, 실제 사용 데이터 기반의 지속 평가는 평가 업계의 새 강점이 되고 있다.
Manus 모회사, 5억 달러 넘는 투자 유치: Meta와 분리 후 독립 재출발
로이터는 10월 8일 Manus의 모회사 Butterfly Effect가 5억 달러가 넘는 투자 라운드를 마쳤다고 전했다. Boyu Capital과 IDG Capital이 공동 주도했고 텐센트, HSG, ZhenFund 등 기존 주주가 참여했다. 이번 투자는 Meta와의 분리 뒤에 이뤄졌다. Meta의 20억 달러가 넘는 Manus 인수는 철회 명령을 받았고, 회사는 8월 독립 운영 재개를 알린 바 있다. 보도에 따르면 홍콩 상장 절차는 빨라도 2027년 이후에나 시작될 전망이다. 범용 에이전트 분야에 대한 분명한 신호다. 인수가 무산돼도 선두 제품에는 자본이 여전히 크게 베팅한다.
OpenAI, 러시아·이란 영향 공작 공개: 가짜 기자가 실제 매체에 게재
OpenAI는 10월 8일 위협 보고서에서 ChatGPT를 이용한 러시아와 이란 출처의 지원 네트워크 두 곳을 차단했다고 밝혔다. 두 공작 모두 가짜 간판 조직을 세워 지정학과 분쟁 관련 메시지를 대상 독자에게 흘려 넣었다. 이란 측은 가짜 기자 페르소나 7개를 운영하며 전 세계 중소 매체에 장문 기사를 투고했고, 약 12개 매체에 실리거나 전재된 기사가 100건 가까이 확인됐다. 러시아 측은 OpenAI의 영향 공작 척도에서 5등급으로 평가돼, 회사가 공개를 시작한 이래 처음으로 이 수준에 올랐다. OpenAI는 지난 2년 반 동안 이런 공작 30건을 폭로했고, 실제 매체에 콘텐츠를 실은 공작이 가짜 소셜 계정만 쓰는 공작보다 더 멀리 닿는 경향이 있다고 밝혔다.
Zenity, AgentCorruption 공개: 프롬프트 하나로 같은 계정의 모든 에이전트 장악
보안 회사 Zenity Labs는 10월 8일 SecTor 2026에서 AgentCorruption이라 이름 붙인 취약점 체인을 공개했다. 대상은 Amazon Bedrock AgentCore로, 공개 에이전트 하나에 프롬프트 하나만 보내 같은 AWS 계정, 같은 리전 안의 모든 AgentCore 에이전트를 장악하고 비공개 대화, 소스 코드, Secrets Manager에 저장된 자격 증명을 읽었으며, 이후 대화를 공격자에게 보내도록 하는 악성 장기 기억까지 심을 수 있었다. 기본 실행 역할의 과도한 권한이 핵심 원인 중 하나다. Zenity는 9월 29일 재점검에서는 AWS가 기본 역할을 크게 강화해 에이전트 간 실행과 비밀 읽기 같은 핵심 권한을 제거한 상태였다고도 밝혔다. 클라우드에서 에이전트를 운영하는 팀은 기본 역할과 최소 권한 설정을 즉시 재점검해야 한다.
OpenAI 연구 책임자 성명: 해고는 안전 우려 제기와 무관
OpenAI는 10월 9일 공식 계정을 통해 연구 책임자 성명을 내고, 해고된 연구자 3명이 전날 낸 공개 서한에 답했다. 성명에 따르면 Jasmine Wang, Mikita Balesni, Tomek Korbak은 지난주 민감 정보 취급 정책을 위반했다는 조사 결과로 해고됐고, 조사에서는 세 사람의 서한에 담긴 내용을 넘는 중대한 신뢰 위반이 드러나 회사는 해고 결정을 유지한다는 입장이다. 동시에 해고가 안전 우려를 제기해서가 아니며, 우려를 말했다는 이유로 직원을 해고하지 않는다고 강조했다. 제3자 안전 평가 기관과의 계약을 마무리 중이며 수주 안에 세부 내용을 공개하겠다고 했고, 최첨단 모델의 모니터링 가능성을 지키려면 업계 전체의 약속이 필요하다는 데도 동의했다. 구체적인 위반 내용은 여전히 공개되지 않아, 양측 주장의 간극은 외부 평가 틀이 확정된 뒤에야 좁혀질 수 있다.
LangChain 예제 Restock: 에이전트 결제는 사람의 승인을 두 번 거친다
LangChain은 10월 8일 공식 블로그에 샘플 프로젝트 Restock을 공개해 에이전트가 안전하게 결제하는 방식을 보였다. Slack에서 도는 사무용품 구매 에이전트로 Managed Deep Agents에 호스팅되고, Stripe의 Link에 결제 수단을 보관해 결제하며, 기계 결제 프로토콜을 지원하는 경로로 주문한다. 핵심 설계는 이중 승인이다. 먼저 Slack에서 사용자가 구매를 확인하고, 다음에 Link에서 결제를 확인한다. 에이전트 자체는 사용자의 결제 자격 증명을 직접 쥐지 않는다. 결제를 에이전트에게 맡기려는 팀에게 가치는 기능보다 절차에 있다. 예산 상한, 사람 승인 지점, 상태 저장을 먼저 두고 자동화는 그다음이다.