Qwenは、Qwen3-Coderのアップグレードと、Alibaba Cloud Model Studioにおけるqwen3-coder-plusインターフェースのリリースを発表しました。この新バージョンでは、実用的なエンジニアリングアプリケーション向けのターミナルタスク機能(ターミナルベンチメトリクスの改善を含む)が強化され、 SWE-Benchの公開スコア69.6を達成しました。また、より安全なコード生成と制約メカニズムも導入されています。Qwenによると、このモデルはQwen CodeおよびClaude Codeのワークフローと互換性があり、長期的な修復、コードレビュー、ツール連携などのシナリオに適しているとのことです。
同時に、 Qwen Codeはマルチモーダル性とサブエージェントを追加し、コラボレーション中に画像(スクリーンショットやエラーメッセージなど)を入力できるようになりました。サブエージェントは取得、変更、テストを実行し、ファイル間およびツールチェーン間のクローズドループの効率を向上させます。APIドキュメントとモデルページが更新され、開発者はコンソールでサンプルを使用してそれらを有効化し、統合できるようになりました。
よくある質問
Q: qwen3-coder-plus と以前のバージョンの違いは何ですか?
A: ターミナルタスクと長いプロセスでのパフォーマンスが向上し、SWE-Bench インジケーターが改善され、より厳格なセキュリティとコンプライアンス ポリシーが追加されました。
Q: クロードコードやクウェンコードと一緒に使えますか?
A: はい。このモデルはプロキシエンコーディング用に設計されており、プロキシとターミナル/ツールの両方の呼び出しとの統合をサポートしています。
Q: Qwen コードのマルチモーダル性は何に使用されますか?
A: スクリーンショットやインターフェース画像を直接アップロードし、テキストの説明と組み合わせて問題箇所を特定できます。サブエージェントが作業を分担し、修正とテストを完了します。
Q: qwen3-coder-plus はどこで呼び出されますか?
A: Alibaba Cloud Model Studio でモデル ページを開き、API の例に従ってアクセスします。オンライン テストと使用状況の表示がサポートされています。
Q: SWE-Bench スコア 69.6 についてどう思いますか?
A: これは公開評価における最高値の一つであり、実際の修理作業における総合的な能力を反映しています。具体的な設定は評価と文書化の対象となります。