
Qwen3.8 Max Preview:機能、Token Plan、リリース状況
qwen3.8-max-preview、1Mコンテキスト、推論、画像理解、Function Calling、組み込みツール、3種類のキャッシュがあります。ただし標準料金のGA Backend APIとEvoLinkルートは未公開です。名称確認: Qwen3.8とQwen3-8Bは別モデルです。旧80億パラメータモデルの料金、ダウンロード、ローカル導入情報はqwen3.8-max-previewには適用されません。
2026年7月21日時点の状況
| 質問 | 現在の回答 | 安全な解釈 |
|---|---|---|
| 公式Previewはあるか | はい | Token Planにqwen3.8-max-previewが掲載されています。 |
| GAか | いいえ | 変更、削除、最終版への置き換えがあり得ます。 |
| 公開IDはあるか | はい | 文書化されたQwenチャネル用で、EvoLink IDとは限りません。 |
| 個人プランのキーをバックエンドで使えるか | いいえ | 自動スクリプト、独自バックエンド、非対話型バッチは禁止です。 |
| 標準トークン料金は公開済みか | いいえ | Creditsはサブスクリプション単位で、一般API料金ではありません。 |
| Open Weightsは公開済みか | まだ | リポジトリ、ライセンス、構成、日程が未確定です。 |
| EvoLinkで利用できるか | まだ | 対応ルートに必要な事実を検証中です。 |
Previewクライアントで使えることと、本番バックエンドで使えることは別です。安定ID、課金、地域、制限、ライフサイクルが未確定の場合があります。
Token Planは標準Qwen APIではない
確認済みの機能
推論強度の明示的な制御
low、medium、xhighを文書化しています。既定値はxhighです。また、複数ターンで推論履歴を扱うための要件もあります。単発の良い回答だけでは、長時間Agentが以前の判断、ツール結果、制約を保持できるとは言えません。
複雑な作業向けテキスト生成
Qwenは高度な推論、コーディング、データ分析、生産性業務を想定しています。これはテスト領域であり、本番の測定結果ではありません。正確性、形式遵守、ループなしの完了、再試行とレビューを含む成功タスク単価を分けて記録します。
画像理解
Token Plan一覧は画像理解を示しています。スクリーンショット、文書、図表、テキストと画像の混合入力は有効な評価対象です。ただし、すべての形式、サイズ、メディア長、EvoLinkルート能力を保証しません。
Token Planの組み込みツール
Web検索、コードインタープリター、Web抽出、類似画像検索、テキストによる画像検索が文書化されています。良い結果がモデル、検索、インタープリター、ハーネスのどこに由来するかを分ける必要があります。

発表済みだが未文書化の項目
Qwenは2.4兆の総パラメータ、Open Weights計画、最先端に近い位置づけを発表しています。重要なシグナルですが、完全なモデルカードではありません。
| 発表 | 開発者に分かること | 未確認事項 |
|---|---|---|
| 総2.4兆パラメータ | 大きなスケールアップ | 有効パラメータ、Expert構成、学習、推論効率 |
| Open Weights計画 | セルフホストの可能性 | リポジトリ、ファイル、ライセンス、日程、ハードウェア |
| Frontierの位置づけ | 能力向上の仮説 | 全表、方法、独立再現、レイテンシ、コスト |
総パラメータだけでは、受け入れ可能な品質、Servingコスト、出力量、ツール復旧、安定性は判断できません。
本番で重要なPreview制限
IDは変わり得る
qwen3.8-max-previewはToken Planの公式IDです。最終版は別の安定エイリアスを使う可能性があります。モデル選択は設定に置きます。Creditsはトークン単価ではない
Creditsはサブスクリプション消費で、期間限定倍率を含む場合があります。ルート固有料金を待ち、成功タスク単価を測定します。
コンテキスト情報はチャネル固有
Qwenの現行モデル一覧はToken Plan Previewに1Mコンテキストを記載しています。これは確認済みのチャネル上限ですが、全位置の検索品質や将来のEvoLinkルートで同一制限を保証しません。
個人Token PlanはバックエンドAPIではない
ルートごとの動作確認が必要
Rate Limit、地域、構造化出力、ストリーミング、キャッシュ、バッチ、ツール、失敗時課金はチャネルで異なる可能性があります。
Qwen3.8の3種類のキャッシュ
| Cache | 作成 | Hit | 最低長 | 利用方法 |
|---|---|---|---|---|
| 明示 | 125% | 10% | 1,024 Token | cache_controlを手動指定 |
| 暗黙 | 100% | 20% | 256 Token | 共通Prefixを自動検出 |
| Session | 125% | 10% | 1,024 Token | Responses APIの複数Turn |
これはQwenチャネルの条件であり、EvoLinkの料金・Cache条件ではありません。
今Qwen3.8を準備すべきチーム
リポジトリ規模のコーディングや長時間Agentを扱うチームは、安定した比較対象、受入基準、Preview変更時のFallbackを今から準備できます。APIテストは本番利用可能なRoute公開後に行います。
安定したバージョンID、予測可能な料金、地域やRate Limit保証が必要、またはサイレント障害を検知できずRollbackもない場合、本番利用は待つべきです。
本番API公開前の準備
今はPrompt、受入基準、Baselineだけを固定します。明確な料金と利用権限を持つ本番APIが公開されるまで、大規模な有料評価は実行しません。
| ワークロード | 例 | 指標 |
|---|---|---|
| リポジトリコード | テスト付き複数ファイル修正 | 合格率、不要変更、再試行、レビュー時間 |
| Agent | 失敗を注入したツールタスク | 精度、復旧、ループ、介入 |
| 画像理解 | UIまたは文書 | Grounding、見落とし、構造化抽出 |
| 長文 | 大規模リポジトリ・文書 | Recall、指示保持、矛盾 |
| データ分析 | 表からレポート | 数値、根拠、成果物品質 |
| 日常作業 | 小規模編集 | 安価なルートに対する価値 |
accepted_task_cost = model_usage + retries + fallback_usage + reviewer_time + defect_repairEvoLinkユーザーの準備
- Qwen3.8先行アクセスページに登録する。
- Kimi K3など利用可能なルートで固定テストセットを作る。
- プロンプト、ツールSchema、合格基準、成果物をProviderから独立させる。
- タスク境界でモデルを設定可能にする。
- 有効化後に同じタスクを再実行し、合格率、レイテンシ、信頼性、コストを比較する。
よくある質問
Qwen3.8は正式リリース済みですか?
2026年7月21日時点でToken Planに正式掲載されたPreviewです。最終GAではありません。
Preview IDは?
qwen3.8-max-previewです。チャネル固有で、最終版やEvoLink IDを保証しません。Qwen3.8とQwen3-8Bは同じですか?
違います。Qwen3.8は2026年版のモデルファミリー、Qwen3-8Bは旧Qwen3の80億パラメータモデルです。
Token PlanとAPIアクセスの違いは?
Token Planは対話型ツール向けCredits購読です。標準APIは自動化アプリ向けで、Token単位で課金されます。
どのQwen3.8 Cacheを選ぶべきですか?
暗黙Cacheが最も簡単で、明示Cacheは管理されたPrefix、Session CacheはResponses API会話に向きます。実際のRoute条件を確認してください。
EvoLinkで使えますか?
まだです。対応ルート、料金、リクエストIDは未公開です。
画像に対応しますか?
Token Plan一覧は画像理解を示します。形式、サイズ、ルート動作はエンドポイントごとに確認が必要です。
Open SourceまたはOpen Weightですか?
Open Weightsが予定されていますが、リポジトリ、ファイル、ライセンス、構成、日程は未確定です。
料金はいくらですか?
Token Planの料金とCreditsは公開されていますが、標準トークン料金とEvoLink料金は未公開です。
Qwen3.7 Maxより優れていますか?
Qwenは能力向上を示していますが、完全な根拠と実ワークロード試験が必要です。Qwen3.7の方が本番仕様は明確です。
リリースまで待つべきですか?
いいえ。対応モデルで開発し、Fallbackと再現可能な試験を用意してください。ルート、価格、制限、結果を確認後に移行します。


