ToolNavs 便利なAIツールを発見
ツール投稿 ログイン

メイトゥアン LongCat

総パラメータ 560B に対して活性化は 27B、さらに毎日 10 万トークンを無料配る。LongCat は敷居をコスト側で下げる。ScMoE と非同期 RL が二本の軸で、対象はテキストから画像・音声・動画へ広がる。

活性化 27B で毎秒 100 トークンを超える。LongCat の選び方はコストにある。Flash-Chat は総 560B・活性化 27B で組み、Flash-Omni はテキスト・画像・音声・動画を一つの離散トークン空間に載せる。API は毎日 10 万トークンを配り、OpenAI と Anthropic の両形式を受け付ける。
LongCat-Next オープンソースリリース:テキスト、画像、音声を統合するネイティブのマルチモーダルモデル

LongCat-Next オープンソースリリース:テキスト、画像、音声を統合するネイティブのマルチモーダルモデル

- 要旨 LongCat-Nextは、MeituanのLongCatチームによるオープンソースの離散ネイティブ自己回帰マルチモーダルモデルで、テキスト、ビジュアル、音声を同じフレームワークで統合することを目指しています。 本プロジェクトはMoEアーキテクチャを採用しており、総パラメータは約68.5B...

Admin
203
Meituan LongCat-Flash-Thinking-2601 オープンエクスペリエンスとAPI:より強力なエージェントおよび脆弱性理解能力を持つと主張

Meituan LongCat-Flash-Thinking-2601 オープンエクスペリエンスとAPI:より強力なエージェントおよび脆弱性理解能力を持つと主張

美団のLongCatチームは「LongCat-Flash-Thinking-2601」をリリース・リリースしました。これは「深く一般的なエージェント思考」のためのバージョンとして位置づけられ、エージェント検索、エージェントツールの使用、ツール統合推論などのタスクで高得点を得ることに重点を置き、ランダ...

Admin
153
LongCat-Video-Avatar オープンソース解釈:オーディオ駆動のロングビデオアバター生成をより安定かつリアルにする方法

LongCat-Video-Avatar オープンソース解釈:オーディオ駆動のロングビデオアバター生成をより安定かつリアルにする方法

1. Abstract LongCat-Video-Avatarは、LongCat-Videoアーキテクチャに基づく音声駆動型アバター(仮想人間)ビデオ生成モデルで、「長時間のシーケンス、強い一貫性、リアルかつ動的な」シナリオに適しています。 ネイティブに音声テキストからビデオ(AT2V)、音声テキ...

Admin
306
LongCat-Imageオープンソース解析:6B DiTが20B+ MoEレベルの中国語・英語バイリンガル画像間モデルを達成

LongCat-Imageオープンソース解析:6B DiTが20B+ MoEレベルの中国語・英語バイリンガル画像間モデルを達成

1. Abstract LongCat-Imageは、MeituanのLongCatチームによる中国語と英語のオープンソースのバイリンガル画像生成・編集モデルで、パラメータは約6B、ハイブリッドDiTアーキテクチャを採用しています。これは多くの公開ベンチマークで20Bレベルのオープンソースモデルと同...

Admin
321
LongCat-Flash-Thinking: MoEと非同期RLのサポート、AIME25はより多くのトークンを節約します

LongCat-Flash-Thinking: MoEと非同期RLのサポート、AIME25はより多くのトークンを節約します

LongCat-Flash-Thinkingは、AIとMoE、非同期RL、エージェントネイティブツールを組み合わせ、ロジック、数学、コーディング、エージェントタスクで最先端のパフォーマンスを実現します。 AIME25は少ないトークンで高い精度を実現するため、企業が低コストで高品質の推論と安定した実装...

Admin
101