アリババトンイーはQwQ-32Bを発表しました:強化学習駆動型推論アップグレード、32Bパラメータはより大きなモデル性能に近似
アリババ・トンイは強化学習を通じた推論能力のさらなる向上に焦点を当てたQwQ-32Bをリリースしました。 ヒープパラメータのスケールだけでなく、このアップデートの核心は320億パラメータモデルを用いて、より大きなモデルが複雑な推論タスクに与える影響を近似し、「より軽いがより思考的」なルートをより明確...
AI情報 • Admin •
86
Found 1 related articles