コンテンツにスキップ
メインサイト ニュース コンソール

Qwen Office、Qwen3.8-Flashを先行リリース:生成速度100%向上、Token消費量75%削減

· 量子位
国内AI

8月26日夜、Qwen Officeは、発表されたばかりの Qwen3.8-Flash モデルをいち早く提供開始するとともに、標準モードを新たに導入しました。本日より、すべてのユーザーが新しい標準モードで Qwen3.8-Flash を利用できます。最新モデルにより、より少ないクレジット消費と、より高速なトークン処理速度でタスクを完了できるようになります。今後、Qwen Officeで提供するモデルは標準モードと上級モードの2種類のみとなります。日常的なタスクの95%はQwen Officeの標準モードで対応でき、上級モードが必要となるのは、複雑なタスクのわずか5%です。

ユーザー体験の向上は、モデルのアップグレードとAgentとの連携最適化によって実現しました。新アーキテクチャを採用した Qwen3.8-Flash は、総パラメータ数1,000億規模で、Claude Opus 4.6を上回る性能を実現しています。同時に、Qwenの大規模モデルチームとQwen Officeチームは、オフィス業務に特化した Qwen3.8-Flash も共同で開発しました。多段階の計画立案、ツール選択、コンテキスト圧縮などのシナリオに向けて専門的なトレーニングとチューニングを行い、さらに推論の最適化と専用の Harness アーキテクチャによって、スループット効率を一段と高めています。実際のオフィス業務を想定したテストでは、Qwen Office標準モードの1タスクあたりの生成速度が約100%向上し、トークン消費量は平均75%削減されました。

実際のAI活用シーンでは、高性能であるほど一般にコストとレイテンシーが増大し、低コストを実現するには知能を犠牲にしなければなりません。Agentとモデルの深い連携による最適化が、性能・コスト・速度の「不可能の三角形」を打ち破ろうとしています。モデルの知能密度が継続的に高まり、Qwen Officeとモデルの双方向の最適化が進むなか、Agentはまもなくトークン消費への不安から解放され、「量を気にせず、十分に使える」時代を迎えようとしています。

本稿はQwenが提供し、量子位が許諾を得て転載したものです。記載内容に関する見解は原著者に帰属します。

#国内AI#Qwen#Omniapi.co

4All API チームによる投稿

原文リンク:https://www.qbitai.com/2026/08/480001.html

主流 AI モデル API をお探しですか?4All API は OpenAI / Anthropic / Google Gemini / Qwen / DeepSeek など数十種類のモデルを単一の API キーで呼び出せます。公式準拠の価格、エンタープライズ品質の通信路、5 分で接続完了。

4All API コンソールに登録 →