Together Link는 2026년 10월 5일 Together AI가 공식 블로그로 공개한 연결 계층이다. 개발자가 이미 쓰는 코딩 에이전트 도구를 그대로 Together AI가 호스팅하는 오픈 모델에 연결한다. 내세우는 바는 단순하다. 도구도, 워크플로도 그대로인데 청구액은 50% 넘게 줄어든다는 것이다. 설치는 명령어 하나로 끝나고 기존 설정과 로그인은 유지되며, 원래의 비공개 모델로 되돌리는 것도 명령어 하나면 된다.
바뀌는 것은 모델뿐, 도구는 그대로다
코딩 에이전트는 이제 개발팀의 일상이 됐지만, 한 줄 수정부터 저장소 전체 재작성까지 많은 작업이 기본값으로 가장 비싼 비공개 모델 하나에서 돌아간다. Together Link가 지원하는 도구는 Claude Code, Claude Desktop, ChatGPT 앱과 CLI의 Codex, OpenCode, Pi로, 현재 주류 사용 방식을 대부분 덮는다. 목표는 또 하나의 코딩 비서를 만드는 것이 아니라 모델 공급 계층만 떼어 내는 것이다. 화면도 단축키도 팀의 습관도 그대로 두고, 뒤쪽의 추론 요청만 오픈 모델로 돌린다.
Auto 라우팅: 어려운 문제는 플래그십에, 작은 일은 Flash에
실제 절감액을 결정하는 것은 Auto 라우터다. 각 세션의 첫 작업을 읽어 난이도를 판단하는데, 간단한 수정은 빠르고 저렴한 모델로 보내고 어려운 문제에만 프런티어급 성능을 쓴다. 라우팅은 세션당 한 번만 이뤄져 프롬프트 캐시가 깨지지 않는다. Anthropic 키를 가져오면 Opus 5.5와 GLM 5.3 사이에서, 없으면 GLM 5.3와 GLM 5.3 Flash 사이에서 고른다. 세션이 끝날 때마다 이번에 실제로 쓴 금액과 같은 세션을 Opus 5.5로 돌렸을 경우의 비용이 나란히 표시된다. 결제는 본인의 Together API 키로 이뤄지며 종량제나 크레딧 팩을 쓰면 되고 별도 계약은 필요 없다.
성립 조건은 오픈 모델이 먼저 따라잡았다는 것
Together AI는 블로그에서 시점을 솔직하게 밝혔다. Kimi K3, GLM 5.3 같은 개방형 가중치 모델은 이제 고난도 코딩 작업 상당수를 처리할 수 있고, GLM 5.3 Flash, DeepSeek V4.1 Flash 같은 소형 모델은 일상 업무를 맡기에 충분하면서 토큰당 가격은 비공개 플래그십의 극히 일부다. 엔지니어링 조직이 비공개 모델에 쓰는 돈은 월 수만 달러에서 수백만 달러에 이르며, 가격 차가 이만큼 벌어지면 라우팅 계층 자체가 독립 사업이 된다. Together AI가 밝힌 수치로 2026년 9월 30일 기준 OpenRouter에서 DeepSeek V4.1 Flash 토큰량의 약 40.8%, GLM 5.3 Flash 약 28.2%, Kimi K3 약 23.1%를 자사가 처리해 공급 측 규모는 이미 갖춰진 상태다.
경계도 분명히 해야 한다. '50% 이상'은 업체 측 주장이고 실제 절감은 팀의 작업 구성에 달려 있다. 세션마다 저장소 규모의 재작성뿐이라면 라우팅이 비집고 들어갈 여지는 작고, 가장 어려운 작업은 Together Link 스스로도 프런티어 모델에 맡긴다. 진짜로 바뀌는 것은 기본값이다. 전부 플래그십으로 돌리는 기본값에서, 이 작업이 플래그십을 쓸 만한 일인지 먼저 묻는 기본값으로. 그것이 이 제품의 핵심이다.