오늘(9월 22일) AI 브리핑: 샤오미가 MiMo-V2.6을 오픈소스로 공개했다. Pro 버전은 Artificial Analysis Intelligence Index에서 46점을 받아 오픈 웨이트 모델 1위에 올랐다. xAI의 Grok 4.7 벤치마크도 같은 날 공개됐는데, 역시 46점, 코딩 에이전트 지표는 56까지 치솟았다. 캐나다 브리티시컬럼비아주는 학교 총격 사건을 두고 OpenAI를 제소했다. 안전팀이 위험 대화를 탐지하고도 경찰에 알리지 않았다는 주장이다. Linear는 AI 코딩 시대의 CI 병목에 어떻게 대응했는지 회고를 공개했다.
샤오미, MiMo-V2.6 오픈소스 공개: Pro 버전 Intelligence Index 46점, 오픈 부문 1위
9월 21일 샤오미는 공식 블로그를 통해 MiMo-V2.6 시리즈를 발표했다. 네이티브 풀모달 모델 Pro와 Flash 2종에 Distill-Qwen-9B, 7천 개가 넘는 RL 태스크 환경과 학습 코드를 묶어 오픈소스로 공개했다.
MiMo-V2.6-Pro는 Artificial Analysis Intelligence Index에서 46점(정확히는 46.32)을 기록했다. Kimi K3와 Qwen3.8 Max를 제치고 오픈 웨이트 모델 1위가 됐다. 다만 Claude Fable 5.1, GPT-6 Astra 같은 클로즈드 최전선 모델과는 아직 격차가 있다. 눈길을 끈 건 '6일간의 RL 학습 생중계'다. Pro와 Flash는 각각 30스텝, 약 75만 개 궤적을 완주했고 비용은 약 262만 달러와 85만 달러. DeepSWE v1.1 분포 외 점수는 각각 약 17점, 14점 올랐다. API 가격은 V2.5와 동일하고, 출력 속도가 최대 20배인 Pro-UltraSpeed 호스팅 티어가 새로 추가됐다.
관련 글: 小米发布 MiMo-V2.6:全模态双版本,把 Agent 执行层做进模型里 (/article/2026-xiaomi-released-mimo-v26-dual-versions-of-full-modality-integrating-the-agent-ex)
Grok 4.7 벤치마크: 종합 46점으로 상위 4개 랩 진입, 코딩 에이전트는 56점
xAI는 9월 21일 Grok 4.7을 출시했다. Artificial Analysis는 Intelligence Index 46점을 매겼다. Grok 4.6보다 2점 올라 xAI는 해당 지수 상위 4개 랩에 진입했다. 다만 Claude Fable 5.1과 GPT-6의 53점과는 7점 차이다.
하이라이트는 코딩이다. 자사 코딩 에이전트 Grok Build와 조합해 Coding Agent Index 56점을 기록했다. 4.6 대비 9점 상승, GPT-5.6 Sol을 제치고 네이티브 harness 구성에서 4위다. 일론 머스크는 X에서 xAI의 에이전틱 코딩이 Anthropic과 OpenAI에 이은 3위라고 주장했다. 장기 실무 태스크(AA-Briefcase)에서는 1657 Elo로 전 세대보다 111 올랐고 Claude Opus 5에 근접했다. GDPval-AA는 1695 Elo(+90). 요금은 100만 토큰당 입력 2달러·출력 6달러로 동결이다.
브리티시컬럼비아주, OpenAI 제소: 안전팀은 위험 대화를 탐지하고도 신고하지 않았다
9월 21일 캐나다 브리티시컬럼비아주 정부는 OpenAI와 샘 올트먼 CEO를 미국 캘리포니아 북부지구 연방지방법원에 제소했다(로이터 단독 보도). 올해 2월 Tumbler Ridge에서 발생한 학교 총격 사건(사망자 9명, 대부분 어린이)이 발단이다.
소장에 따르면 범인 Jesse Van Rootselaar는 ChatGPT 대화에서 총기 폭력을 언급한 뒤 OpenAI 안전팀에 의해 고위험으로 분류됐다. 하지만 회사는 경고를 사법당국에 전달하지 않았다. 주 정부는 비극을 막을 수 있었다고 주장하며 학교 재건과 정신건강 등 재난 대응 비용의 손해배상, 폭력 대화 처리 절차 개혁을 명하는 법원 명령을 요구했다. 이미 30명이 넘는 유족이 캘리포니아 연방법원에 소송을 제기한 상태다. OpenAI 대변인은 '말로 표현할 수 없는 비극'이라며 사법당국 협력 의사를 밝혔다.
관련 글: 不列颠哥伦比亚省起诉 OpenAI:内部标记风险账号却未报警 (/article/2031-british-columbia-sues-openai-risk-account-flagged-internally-police-never-alerte)
Linear, CI 개선 회고 공개: AI가 빨리 쓸수록 검증은 비싸진다
9월 21일 Linear는 공식 엔지니어링 블로그에 CI 개선 회고를 올렸다. 제목 'CI costs are high'는 CTO Tuomas Artman이 직접 할당한 이슈의 문구 그대로다.
핵심 주장은 뼈아프게 명확하다. AI 코딩 덕분에 코드를 쓰는 속도는 기하급수적으로 빨라졌는데, 모든 PR은 여전히 CI를 통과해야 한다. 검증 단계가 새로운 병목이 돼 인프라 비용을 끌어올리고 개발자와 에이전트를 피드백 대기 상태로 놀게 만든다. 개선 후 테스트 스위트는 연초 대비 약 4배로 불었는데도 PR 대기 시간은 6분대에서 5분 초반으로 줄었다. 단위 테스트 러너 시간은 절반으로 감소했다. 처방은 인프라·툴체인 업그레이드, 블로킹 작업 최적화, 중복 셋업 제거, 테스트 실행 효율화. 글은 이런 최적화가 TypeScript 외의 언어와 툴체인에도 통한다고 강조했다.
이번 브리핑은 4건 수록. 모두 24시간 이내 공식 출처(공식 블로그, 공식 발표, Artificial Analysis 벤치마크, 로이터 단독 보도)로 확인했다. 제외된 4건의 사유는 다음과 같다. Kimi 브라우저 확장('WebBridge 개명'은 실제로 9월 17일), transformers의 GGUF 지원(예전부터 있던 기존 기능, 신규 릴리스 아님), NVIDIA Nemotron 3.5 Lightning(8월 11일 구 릴리스), Step 5 Preview(9월 18일 릴리스로 24시간 창 초과).