2026.08.26 WED23:03 JSTAlibaba
Qwen Qwen3.8-Flash投入
- Qwen3.8-Flash(125B-A6B級)をコスト効率特化で投入
- 26万〜1Mコンテキスト、マルチモーダル。訓練コスト1/9程度
- API $0.16/$0.47。weights公開、コーディング・オフィス強化
目線
高コストモデル代替として、コーディングや長文処理のAPI料金・性能を即比較する段階。
対象
API利用者・コスト敏感なエージェント開発者
使える場面
- 長コンテキストのコードベース処理
- マルチモーダルなオフィス/エージェント作業
- 既存Qwenや他Flashモデルとの料金比較
試すなら
QwenCloudやHFで仕様・ベンチを確認しAPIを試す
確認点
本番API提供タイミングと正確な料金・地域を公式で確認
背景
Qwen4アーキテクチャのプレビュー要素を含むコスト効率特化モデル。Qwen3.7-Plusより訓練コスト大幅減で性能向上。
何が変わったか
- 総パラメータ約125B・活性6BのMoE、N-gram embedding採用
- ネイティブ262kコンテキスト(YaRNで1M)、マルチモーダル
- コーディング・オフィスタスクで前世代を上回る
- QwenCloud API価格 入力$0.16/出力$0.47 per M tokens。weightsをHF/ModelScope公開
使える場面・影響
低活性パラメータで大型モデル級を狙うため、高頻度利用の推論コスト前提が下がる。
試す前に確認
- API本番開始時期
- 正確なモデルIDと対応ツール(Claude Code等)
- 商用利用条件・提供地域
一次ソース
- The Decoder報道(詳細)the-decoder.com
- QwenCloud changelogdocs.qwencloud.com