このモデルは非推奨です。デフォルトの入力トークン数1万のワークロードでのみ性能測定を継続しています。他のワークロードの結果は過去のデータであり、更新されません。
Alibabaは新しいリリースであるQwen3.5 9Bを公開しています。こちらの利用をご検討ください。
Qwen3 VL 8B Instructの知能、性能、料金の分析
Qwen3 VL 8B Instructの知能は平均を上回りますが、料金は特に高価です。これは同程度の規模の他の非推論オープンウェイトモデルと比較した場合です。 このモデルはテキスト、画像入力に対応し、テキストを出力します。コンテキストウィンドウは256kトークンです。
Qwen3 VL 8B InstructのArtificial Analysis Intelligence Indexスコアは7で、同等のモデルの中では平均以上です(中央値:6)。
Qwen3 VL 8B Instructの料金は入力100万トークンあたり$0.18(高価、中央値:$0.03)、出力100万トークンあたり$0.70(高価、中央値:$0.14)です。
Qwen3 VL 8B Instructの出力速度は毎秒120トークンで、特に速い水準です(96)。
| 推論 | いいえ このページでは、このモデルの非推論版を表示しています。 推論版も存在する可能性があります。 |
|---|---|
| 入力モダリティ | 対応:テキスト、画像 |
| 出力モダリティ | 対応:テキスト |
| コンテキストウィンドウ | 256k Arial 12ポイントのA4用紙約384ページ分 |
| 総パラメーター数 | 8.8B |
| ライセンス | Apache 2.0 |
| モデルウェイト | Hugging Face |
各指標は同じクラスのモデルと比較します。
- 非推論モデル → 他の非推論モデルとのみ比較
- 推論モデル → 推論モデルと非推論モデルの両方と比較
- オープンウェイトモデル → 同じ規模クラスの他のオープンウェイトモデルとのみ比較:
- 極小:パラメーター数≤4B
- 小:パラメーター数4B~40B
- 中:パラメーター数40B~150B
- 大:パラメーター数>150B
- 独自モデル → 入力/出力のブレンド料金を3:1として、同じ料金帯の独自モデルとオープンウェイトモデルを比較:
- 100万トークンあたり<$0.15
- 100万トークンあたり$0.15~$1
- 100万トークンあたり>$1
知能Updated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index:オープンウェイトとプロプライエタリ
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Omniscience
AA-Omniscience Index
Openness Index
Artificial Analysis Openness Index:スコア
Intelligence Indexの比較
Intelligence Index とタスクあたりのコスト
費用
Intelligence Index タスクあたりのコスト
Artificial Analysis Intelligence Index の実行コスト
料金:キャッシュヒット・入力・出力
コンテキストウィンドウ
コンテキストウィンドウ
速度
出力速度(1秒あたりのトークン数)で測定
出力速度
Intelligence Indexのタスクあたりの時間
遅延
最初のトークンまでの時間(秒)で測定
遅延: 最初の回答トークンまでの時間
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
エンドツーエンド応答時間
モデル規模(オープンウェイトモデルのみ)
モデルサイズ:総パラメータ数とアクティブパラメータ数
よくある質問
Qwen3 VL 8B Instructに関するよくある質問
Qwen3 VL 8B Instructは2025年10月14日にリリースされました。
Qwen3 VL 8B InstructはAlibabaが開発しました。
Qwen3 VL 8B InstructのArtificial Analysis Intelligence Indexの推定スコアは7で、同程度の規模の他の非推論オープンウェイトモデルの中では平均以上水準です(中央値:6)。
Qwen3 VL 8B Instructの出力速度は毎秒119.8トークンです(AlibabaのAPIに基づく)。同程度の規模の他の非推論オープンウェイトモデルと比べて平均を大きく上回る水準です(中央値:96.3 t/s)。
Qwen3 VL 8B Instructの最初のトークンまでの時間(TTFT)は2.29秒です(AlibabaのAPIに基づく)。同程度の規模の他の非推論オープンウェイトモデルと比べて平均よりやや長い水準です(中央値:2.19秒)。
Qwen3 VL 8B Instructの料金は入力100万トークンあたり$0.18(平均よりやや高い、中央値:$0.15)、出力100万トークンあたり$0.70(平均よりやや高い、中央値:$0.34)です。AlibabaのAPIに基づきます。
Qwen3 VL 8B Instructの料金は入力100万トークンあたり$0.18、出力100万トークンあたり$0.70です(AlibabaのAPIに基づく)。キャッシュヒット/入力/出力を7:2:1とするブレンド料金は、100万トークンあたり$0.23です。料金はプロバイダーによって異なる場合があります。 プロバイダー料金を比較
いいえ。Qwen3 VL 8B Instructは推論モデルではありません。思考の連鎖による長い推論を行わず、直接回答します。
Qwen3 VL 8B Instructはテキスト、画像入力に対応しています。
Qwen3 VL 8B Instructはテキスト出力に対応しています。
はい。Qwen3 VL 8B Instructは画像入力に対応し、画像の分析、説明、画像に関する質問への回答が可能です。
はい。Qwen3 VL 8B Instructはマルチモーダルです。テキスト、画像入力を処理し、テキスト出力を生成できます。
Qwen3 VL 8B Instructのコンテキストウィンドウは260kトークンです。これは、モデルが1回のリクエストで処理できるテキストと会話履歴の量を決定します。
はい。Qwen3 VL 8B Instructはオープンウェイトモデルです。モデルウェイトが一般公開されており、ダウンロードしてセルフホストできます。
Qwen3 VL 8B Instructのパラメーター数は8.77Bです。
Qwen3 VL 8B InstructはApache 2.0ライセンスで公開されており、商用利用が認められています。 ライセンスを表示
Qwen3 VL 8B InstructのArtificial Analysis Intelligence Indexスコアは7です。この複合ベンチマークでは、推論、知識、数学、コーディングについてモデルを評価します。
はい。Qwen3 VL 8B Instructは1社のプロバイダーを通じてAPIで利用できます。 APIプロバイダーを比較
Qwen3 VL 8B Instructは1社のAPIプロバイダーを通じて利用できます。 プロバイダーを比較