Qwenが公開した、もう一つのオープンウェイトモデルです。これは「マルチモーダル MoE モデルであり、同時に Qwen4 で採用されるアーキテクチャの初期プレビュー版でもあります」。
規模はかなり大きく、125B 個のトークンを含む一方で、毎回アクティブになるのは 6B のみです。これにより、大幅な性能向上が期待できます。
私は現在、Unsloth が量子化したこれらのモデルを DGX Spark 上で継続的にテストしています。まだこのモデルを評価している段階ですが、これまでに 72.5GB の UD-IQ1_S 版(このペリカンを生成)と、78.9GB の UD-Q2_K_XL 版(これらの画像を生成)を試しました。
現時点で最も気に入っているのは、推論強度を xhigh に設定した UD-Q2_K_XL が生成したこの画像です。
