Ali Baba Qwenチームは、水曜日にQwen 3.8-Flash-Nextを起動し、完全なフラッグシップモデルではなく、Qwen 4構造の次世代のプレビューとして配置する予定です。 この段階では、構造のオリエンテーションとパラメータ設計に注力し、性能のパフォーマンスが同時に公開されていない。
1億の合計パラメータ、一度に6億の有効化
プレパブリッシングノートによると、モデルは合計12.5億のパラメータのために設計されていますが、トークンあたりわずか6億のパラメータが有効になっています。 Qwenチームはマルチモードモデルとして説明し、開発者が完全なQwen 4シリーズに適応できるように事前にリリースされたことを示しました。
利用可能な情報に基づいて、モデルは、おそらくハイブリッドの専門家構造を使用しています。つまり、異なる機能の分割は複数のサブモデルに、推論は、現在のミッションに関連するそれらの部分だけを使用しています。 より大きなモデルサイズを維持しながら、単一の操作に必要な計算を削減します。
ポジショニングは公式のフラッグシップではありません。
QwenチームとHugging Faceは、このバージョンをプレビューに近づけます。 これは、リリースの焦点は、新しい世代のモデル全体を与えるだけでなく、開発者がその後の公式バージョンのために準備できるように、以前の構造改善のいくつかを配信するだけでなく、ということです。
設計「3.8」は、Qwen 4の公式ランディングよりもトランジカルバージョンのようなものも反映しています。 記事によると、チームは今、完全な交換で更新を包装するよりも新しい構造の方向に重点を置いています。
ベンチマークテストはまだ公開されていません
Qwenは、独自のQwen 3シリーズや海外の主流モデルとの比較の結果を発表しませんでした。また、ModeScopeにモデル重量が配置されていました。 その結果、外部の世界の可能性は、チームによって開示されたパラメータ情報に基づいて判断することができ、実際の業績は検証されるままである。
この記事では、中国のオープンソースモデルのリリース率が近年加速し続けていると言及しています。 Ali Baba、DeepSeek、Moonshottなどのチームは、継続的にダウンロード可能、微調整、ローカルでオープンな重量モデルを実行しています。 Qwen が計画どおりにこの時間をリリースすると、12.5 億の全体的なパラメータを持つオープンモデルと、$ 6 億の有効化パラメータは、開発者が高性能モデルを使用するためのしきい値をさらに下げることができます。
