Ling 3.0 Flashの知能、性能、料金の分析
Ling 3.0 Flashの知能は最先端モデルの一群に入ります。料金は妥当です。これは同程度の規模の他のオープンウェイトモデルと比較した場合です。 このモデルはテキスト入力に対応し、テキストを出力します。コンテキストウィンドウは262kトークンです。
Ling 3.0 FlashのArtificial Analysis Intelligence Indexスコアは25で、同等のモデルの中では平均を大きく上回る水準です(中央値:8)。
Ling 3.0 Flashの料金は入力100万トークンあたり$0.07(中程度、中央値:$0.07)、出力100万トークンあたり$0.22(中程度、中央値:$0.22)です。
Ling 3.0 Flashの出力速度は毎秒368トークンで、特に速い水準です(135)。
| 推論 | はい このページでは、このモデルの推論版を表示しています。 非推論版も存在する可能性があります。 |
|---|---|
| 入力モダリティ | 対応:テキスト |
| 出力モダリティ | 対応:テキスト |
| コンテキストウィンドウ | 262k Arial 12ポイントのA4用紙約393ページ分 |
| 総パラメーター数 | 124B |
| 有効パラメーター数 | 5.1B 推論時にトークンごとに有効になるパラメーター数 |
各指標は同じクラスのモデルと比較します。
- 非推論モデル → 他の非推論モデルとのみ比較
- 推論モデル → 推論モデルと非推論モデルの両方と比較
- オープンウェイトモデル → 同じ規模クラスの他のオープンウェイトモデルとのみ比較:
- 極小:パラメーター数≤4B
- 小:パラメーター数4B~40B
- 中:パラメーター数40B~150B
- 大:パラメーター数>150B
- 独自モデル → 入力/出力のブレンド料金を3:1として、同じ料金帯の独自モデルとオープンウェイトモデルを比較:
- 100万トークンあたり<$0.15
- 100万トークンあたり$0.15~$1
- 100万トークンあたり>$1
ハイライト
知能Updated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Agentic tool use
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Briefcase v1.1Updated
AA-Briefcase Elo
AA-Omniscience
AA-Omniscience Index
Openness Index
Artificial Analysis Openness Index: Score
Intelligence Indexの比較
Intelligence Index vs. Cost per Intelligence Index Task
費用
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
コンテキストウィンドウ
Context Window
速度
出力速度(1秒あたりのトークン数)で測定
Output Speed
Time per Intelligence Index Task
遅延
最初のトークンまでの時間(秒)で測定
Latency: Time To First Answer Token
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
モデル規模(オープンウェイトモデルのみ)
Model Size: Total and Active Parameters
よくある質問
Ling 3.0 Flashに関するよくある質問
Ling 3.0 Flashは2026年8月4日にリリースされました。
Ling 3.0 FlashはInclusionAIが開発しました。
Ling 3.0 FlashのArtificial Analysis Intelligence Indexの推定スコアは25で、同程度の規模の他のオープンウェイトモデルの中では平均を大きく上回る水準です(中央値:8)。
Ling 3.0 Flashの出力速度は毎秒368.1トークンです(InclusionAIのAPIに基づく)。同程度の規模の他のオープンウェイトモデルと比べて平均を大きく上回る水準です(中央値:135.4 t/s)。
Ling 3.0 Flashの最初のトークンまでの時間(TTFT)は3.04秒です(InclusionAIのAPIに基づく)。同程度の規模の他のオープンウェイトモデルと比べて長い部類水準です(中央値:2.17秒)。
Ling 3.0 Flashの料金は入力100万トークンあたり$0.07(非常に競争力が高い、中央値:$0.30)、出力100万トークンあたり$0.22(非常に競争力が高い、中央値:$0.81)です。InclusionAIのAPIに基づきます。
Ling 3.0 Flashの料金は入力100万トークンあたり$0.07、出力100万トークンあたり$0.22です(InclusionAIのAPIに基づく)。キャッシュヒット/入力/出力を7:2:1とするブレンド料金は、100万トークンあたり$0.05です。料金はプロバイダーによって異なる場合があります。 プロバイダー料金を比較
はい。Ling 3.0 Flashは推論モデルです。回答前に拡張思考や思考の連鎖による推論を行い、複雑な問題に取り組みます。
Ling 3.0 Flashはテキスト入力に対応しています。
Ling 3.0 Flashはテキスト出力に対応しています。
いいえ。Ling 3.0 Flashは画像入力に対応していません。処理できるのはテキストのみです。
いいえ。Ling 3.0 Flashはマルチモーダルではなく、テキスト入力のみに対応しています。
Ling 3.0 Flashのコンテキストウィンドウは260kトークンです。これは、モデルが1回のリクエストで処理できるテキストと会話履歴の量を決定します。
はい。Ling 3.0 Flashはオープンウェイトモデルで、モデルウェイトが一般公開されています。
Ling 3.0 Flashのパラメーター数は124Bで、そのうち5.1Bが有効です。
Ling 3.0 Flashは総パラメーター数124BのMixture of Experts(MoE)モデルですが、推論時に使用する有効パラメーター数は5.1Bのみです。
Ling 3.0 FlashのArtificial Analysis Intelligence Indexスコアは25です。この複合ベンチマークでは、推論、知識、数学、コーディングについてモデルを評価します。
はい。Ling 3.0 Flashは2社のプロバイダーを通じてAPIで利用できます。 APIプロバイダーを比較
Ling 3.0 Flashは2社のAPIプロバイダーを通じて利用できます。 プロバイダーを比較
