一次情報で読む、いまのAI
← すべてのニュース

Qwen 3.8-Flash低コストモデル

目線

コーディングやオフィス作業でコストを抑えたい開発者は、既存の高効率モデルと性能・料金を比較する材料になる。

対象

API利用者・ローカルLLM試用者・コーディング支援開発者

使える場面

  • 長文コンテキストでの文書処理
  • コーディングエージェント試作
  • コスト比較ベンチマーク

試すなら

オープンウェイトをダウンロードして評価するかAPI提供を待つ

確認点

本番APIはまもなく提供予定で、正確な料金・利用条件は公式で再確認

背景

Qwenシリーズのコスト効率重視モデルとして、Qwen4アーキテクチャの先行プレビューも兼ねる。

何が変わったか

  • 総パラメータ125B+N-gram埋め込み51B、トークンあたり活性6BのMoE
  • ネイティブコンテキスト262Kトークン(YaRNで1Mまで拡張)
  • Qwen3.7-Plus比で訓練コスト約1/9、コーディング・オフィス性能向上
  • Qwen3.8-Flash-Nextのウェイトをオープンソース公開

使える場面・影響

低コストで高性能を狙う用途で採用候補が増え、特に長コンテキストやエージェント構築の試行コストが下がる。

試す前に確認

  • API料金: 入力約0.16ドル/百万トークン、出力約0.47ドル/百万トークン前後
  • オープンウェイトはHugging Face等で入手可能
  • 提供地域・商用条件はQwenCloud公式で確認

一次ソース