ToolNavs 유용한 AI 도구 찾기
도구 제출 로그인
돌아가기 AI 정보
머스크, Grok 4.7이 Opus 5.5에 못 미친다고 인정…xAI는 현실 세계 엔지니어링 데이터에 베팅

머스크, Grok 4.7이 Opus 5.5에 못 미친다고 인정…xAI는 현실 세계 엔지니어링 데이터에 베팅

AI 정보 • Admin • • 11 회 조회

Grok 4.7에 대한 가장 신랄한 평가는 질문을 피할 것 같지 않은 인물의 입에서 나왔다. 9월 27일, xAI 창업자 일론 머스크는 중국미디어그룹(CMG)과의 인터뷰에서 Grok 4.7이 Anthropic의 신모델 Opus 5.5에 미치지 못한다고 인정했다. 그의 표현은 "a solid workhorse of a model"(믿음직한 일꾼 같은 모델)이었고, "막 출시된 Opus 5.5만큼 좋지는 않다"는 것이었다. 테슬라 글로벌 엔지니어링 본부에서 진행된 이 인터뷰에서 머스크는 경쟁사와의 격차를 이례적으로 구체적인 수치로 밝혔다. xAI가 본격적으로 AI에 뛰어든 지 약 3년, Anthropic은 약 6년이며, "내년 중 어느 시점"에 프런티어 수준을 따라잡을 것으로 전망했다.

구체적으로 무엇을 말했나

격차를 인정한 것을 넘어, 머스크는 이번 인터뷰에서 이전에 공개되지 않았던 사업 신호들을 내놓았다.

  • Grok Bot의 급성장: xAI의 개인용 디지털 어시스턴트 Grok Bot은 "매달 약 100%씩 성장"하고 있으며, 그가 직접 언급한 가장 빠르게 성장하는 제품군 중 하나다.
  • 현실 세계로의 데이터 전략 전환: xAI는 지금까지 SpaceX의 학습 데이터 중 "아주 일부"만 사용했으며, 앞으로 테슬라의 학습 데이터도 도입할 계획이다. 목표는 AI를 "현실 세계 엔지니어링"(real world engineering)에 강하게 만드는 것이며, Anthropic의 강점은 AI를 소프트웨어 엔지니어링에 강하게 만드는 것이라고 설명했다.
  • 중국 모델에 대한 평가: 중국의 AI 모델은 우수하며 단위 연산당 성능은 세계 최고라고 평가했고, 중국이 2~3년 안에 리소그래피와 칩 연산 제약을 해결할 것으로 전망했다.

인터뷰에서는 사이버캡(Cybercab)의 텍사스 상용 운행, 10년 안에 휴머노이드 로봇이 10억 대를 넘을 것이라는 전망, "보편적 고소득"(universal high income)도 언급됐지만, 이는 머스크 특유의 장기 비전으로 위 세 가지만큼의 정보량은 없다.

기존의 어조와 다른 점

머스크가 Grok을 말할 때는 그동안 "모든 것을 뛰어넘는다"는 공세적 자세가 대부분이었다. Opus 5.5에 미치지 못한다고 공개적으로 인정하고, 따라잡는 시점을 "내년"이라고 못 박은 것은 사실상 기대치 관리다. 단기적인 뒤처짐을 먼저 테이블 위에 올려놓고, 이야기를 xAI 고유의 데이터 해자로 돌린 셈이다.

시간 순서도 주목할 만하다. Opus 5.5는 9월 22일 출시되자마자 Text Arena 1위에 올랐다(이 칼럼의 9월 27일 AI 브리핑 참조). Grok 4.7은 7월 말부터 시작된 고속 릴리스 주기 아래의 주력 버전으로, 이전 평가에서는 에이전트형 코딩에서 4위권에 진입했지만 작업당 약 8만 토큰을 소모하는 것으로 나타났다. "solid workhorse"라는 평가는 이 프로필과 거의 일치한다. 믿음직한 일꾼이지만 최강은 아니다.

'패배 선언' 뒤에 숨은 세 가지 신호

첫째, 경쟁의 초점이 "누구의 모델이 더 똑똑한가"에서 "누구의 데이터를 남이 가질 수 없는가"로 이동하고 있다. Anthropic은 AI를 소프트웨어 엔지니어링 전문가로 만들고 있고, xAI는 로켓·공장·자율주행에서 축적된 실제 물리 데이터를 해자로 바꾸려 한다. 다만 머스크 스스로 인정했듯 SpaceX 데이터는 "지금까지 아주 일부"만 쓰였다. 이 서사는 아직 청사진 단계이며, Grok 4.5가 SpaceX와 테슬라에서 비공개 테스트에 들어갔을 때 깔아둔 복선이 회수될지는 향후 투자에 달렸다.

둘째, Grok Bot의 월 100% 성장은 xAI의 무게중심이 소비자용 개인 비서로 기울고 있음을 보여준다. 프런티어 연구소들은 모두 "모델 바깥"의 성장 곡선을 찾고 있다. Meta도 최근 개인 에이전트에 하드웨어를 결합하는 움직임을 보였다. 일반 사용자에게 Grok의 향후 경험 향상은 기반 모델 자체보다 Bot 같은 제품 형태에서 나올 가능성이 크다.

셋째, 개발자의 모델 선정에 대한 시사점은 명확하다. 프런티어급 능력이 필요한 작업에는 현시점에서 Opus 5.5가 더 안정적인 선택이며, Grok 4.7의 위치는 "믿음직한 일꾼"이다. 비용과 안정성에 민감하고 극한의 능력을 요구하지 않는 시나리오에 적합하다. xAI가 현실 세계 엔지니어링 데이터를 실제로 활용하기 시작할 때 이 판단이 비로소 바뀔 수 있다.

추천 도구

더보기