Together Link は 2026 年 10 月 5 日、Together AI が公式ブログで発表した接続レイヤーです。開発者がすでに使っているコーディングエージェントツールをそのまま、Together AI 上のオープンモデルにつなぎます。売り文句は明快で、ツールは同じ、ワークフローも同じ、請求額は 50% 以上削減。セットアップはコマンド 1 つで、既存の設定とログインはそのまま残り、ネイティブのクローズドモデルに戻すのもコマンド 1 つです。
交換されるのはモデルだけで、ツールは交換されない
コーディングエージェントは開発チームの日常になりましたが、1 行の修正からリポジトリ全体の書き換えまで、多くのタスクが既定で最も高価なクローズドモデルに流れています。Together Link が対応する載せ先は Claude Code、Claude Desktop、ChatGPT アプリと CLI の Codex、OpenCode、Pi で、現在の主流の使い方をほぼ覆います。狙いは新しいコーディング助手を作ることではなく、モデル供給の層だけを抜き出すことです。画面もショートカットもチームの習慣もそのままに、背後の推論リクエストだけをオープンモデルへ回します。
Auto ルーティング:難問は旗艦へ、小さな仕事は Flash へ
節約額を決めるのは Auto ルーターです。各セッションの最初のタスクを読んで難易度を判定し、簡単な修正は高速で安いモデルへ、難問だけにフロンティア級の能力を割り当てます。ルーティングはセッションごとに 1 回だけ行うため、プロンプトキャッシュが壊れません。Anthropic のキーを持ち込めば Opus 5.5 と GLM 5.3 の間で、なければ GLM 5.3 と GLM 5.3 Flash の間で振り分けます。セッションが終わるごとに、実際の支出と、同じセッションを Opus 5.5 で回した場合の費用が並べて表示されます。課金は自分の Together API キー経由で、従量制かクレジットパックを選べ、別途の契約は不要です。
前提は、オープンモデルが先に追いついたこと
Together AI はブログでタイミングを率直に述べています。Kimi K3 や GLM 5.3 のようなオープンウェイトモデルは高難度のコーディングタスクの多くをこなせるようになり、GLM 5.3 Flash や DeepSeek V4.1 Flash のような小型モデルは日常業務を十分に担い、価格はクローズド旗艦の何分の一かです。開発組織がクローズドモデルに払う額は月数万ドルから数百万ドルに及び、価格差がここまで開くと、ルーティングそのものが独立したビジネスになります。Together AI の公表値では、2026 年 9 月 30 日時点で OpenRouter 上のトークン量シェアは DeepSeek V4.1 Flash が約 40.8%、GLM 5.3 Flash が約 28.2%、Kimi K3 が約 23.1% と、いずれも最大で、供給側の規模はすでに出来上がっています。
境界もはっきりさせておきます。「50% 以上」はベンダーの主張であり、実際の節約はチームのタスク構成に依存します。セッションが軒並みリポジトリ級の難作業なら、ルーティングの工夫の余地は小さく、最も難しいタスクは Together Link 自身もフロンティアモデルに委ねます。本当に変わるのは既定値です。全て旗艦モデルで回す既定から、このタスクは旗艦に値するかと先に問う既定へ。それがこの製品の核心です。