8月26日夜、Qwen Officeは、発表されたばかりの Qwen3.8-Flash モデルをいち早く提供開始するとともに、標準モードを新たに導入しました。本日より、すべてのユーザーが新しい標準モードで Qwen3.8-Flash を利用できます。最新モデルにより、より少ないクレジット消費と、より高速なトークン処理速度でタスクを完了できるようになります。今後、Qwen Officeで提供するモデルは標準モードと上級モードの2種類のみとなります。日常的なタスクの95%はQwen Officeの標準モードで対応でき、上級モードが必要となるのは、複雑なタスクのわずか5%です。

ユーザー体験の向上は、モデルのアップグレードとAgentとの連携最適化によって実現しました。新アーキテクチャを採用した Qwen3.8-Flash は、総パラメータ数1,000億規模で、Claude Opus 4.6を上回る性能を実現しています。同時に、Qwenの大規模モデルチームとQwen Officeチームは、オフィス業務に特化した Qwen3.8-Flash も共同で開発しました。多段階の計画立案、ツール選択、コンテキスト圧縮などのシナリオに向けて専門的なトレーニングとチューニングを行い、さらに推論の最適化と専用の Harness アーキテクチャによって、スループット効率を一段と高めています。実際のオフィス業務を想定したテストでは、Qwen Office標準モードの1タスクあたりの生成速度が約100%向上し、トークン消費量は平均75%削減されました。
実際のAI活用シーンでは、高性能であるほど一般にコストとレイテンシーが増大し、低コストを実現するには知能を犠牲にしなければなりません。Agentとモデルの深い連携による最適化が、性能・コスト・速度の「不可能の三角形」を打ち破ろうとしています。モデルの知能密度が継続的に高まり、Qwen Officeとモデルの双方向の最適化が進むなか、Agentはまもなくトークン消費への不安から解放され、「量を気にせず、十分に使える」時代を迎えようとしています。
本稿はQwenが提供し、量子位が許諾を得て転載したものです。記載内容に関する見解は原著者に帰属します。