2026.08.26 WED21:35 JSTAlibaba
Qwen 3.8-Flash低コストモデル
- Alibaba QwenがQwen3.8-Flashを公開。マルチモーダルMoE。
- 125Bパラメータ(活性6B)で訓練コストは前世代の約1/9。
- APIは入力約0.16ドル/百万トークン、オープンウェイトも提供。
目線
コーディングやオフィス作業でコストを抑えたい開発者は、既存の高効率モデルと性能・料金を比較する材料になる。
対象
API利用者・ローカルLLM試用者・コーディング支援開発者
使える場面
- 長文コンテキストでの文書処理
- コーディングエージェント試作
- コスト比較ベンチマーク
試すなら
オープンウェイトをダウンロードして評価するかAPI提供を待つ
確認点
本番APIはまもなく提供予定で、正確な料金・利用条件は公式で再確認
背景
Qwenシリーズのコスト効率重視モデルとして、Qwen4アーキテクチャの先行プレビューも兼ねる。
何が変わったか
- 総パラメータ125B+N-gram埋め込み51B、トークンあたり活性6BのMoE
- ネイティブコンテキスト262Kトークン(YaRNで1Mまで拡張)
- Qwen3.7-Plus比で訓練コスト約1/9、コーディング・オフィス性能向上
- Qwen3.8-Flash-Nextのウェイトをオープンソース公開
使える場面・影響
低コストで高性能を狙う用途で採用候補が増え、特に長コンテキストやエージェント構築の試行コストが下がる。
試す前に確認
- API料金: 入力約0.16ドル/百万トークン、出力約0.47ドル/百万トークン前後
- オープンウェイトはHugging Face等で入手可能
- 提供地域・商用条件はQwenCloud公式で確認
一次ソース
- Reutersreuters.com
- Bloombergbloomberg.com
- Qwen公式Xx.com
- Qwen Researchqwen.ai