一次情報で読む、いまのAI
← すべてのニュース

Qwen Qwen3.8-Flash投入

目線

高コストモデル代替として、コーディングや長文処理のAPI料金・性能を即比較する段階。

対象

API利用者・コスト敏感なエージェント開発者

使える場面

  • 長コンテキストのコードベース処理
  • マルチモーダルなオフィス/エージェント作業
  • 既存Qwenや他Flashモデルとの料金比較

試すなら

QwenCloudやHFで仕様・ベンチを確認しAPIを試す

確認点

本番API提供タイミングと正確な料金・地域を公式で確認

背景

Qwen4アーキテクチャのプレビュー要素を含むコスト効率特化モデル。Qwen3.7-Plusより訓練コスト大幅減で性能向上。

何が変わったか

  • 総パラメータ約125B・活性6BのMoE、N-gram embedding採用
  • ネイティブ262kコンテキスト(YaRNで1M)、マルチモーダル
  • コーディング・オフィスタスクで前世代を上回る
  • QwenCloud API価格 入力$0.16/出力$0.47 per M tokens。weightsをHF/ModelScope公開

使える場面・影響

低活性パラメータで大型モデル級を狙うため、高頻度利用の推論コスト前提が下がる。

試す前に確認

  • API本番開始時期
  • 正確なモデルIDと対応ツール(Claude Code等)
  • 商用利用条件・提供地域

一次ソース