Google: Models Intelligence, Performance & Price

Google
Google

This analysis is intended to support you in choosing the best model provided by Google for your use-case.

Most Intelligent

Updated
#1
Claude Opus 5 (max)Claude Opus 5 (max)
51
#2
Claude Fable 5 (with fallback)Claude Fable 5 (with fallback)
50
#3
Claude Opus 5 (xhigh)Claude Opus 5 (xhigh)
50
#4
Claude Opus 5 (high)Claude Opus 5 (high)
48
#5
Claude Opus 5 (medium)Claude Opus 5 (medium)
45

Intelligence index

Total 59 models

Fastest

#1
gpt-oss-20b (high) Vertexgpt-oss-20b (high) Vertex
397 t/s
#2
gpt-oss-20b (low) Vertexgpt-oss-20b (low) Vertex
362 t/s
#3
Gemini 3.5 Flash-Lite AI StudioGemini 3.5 Flash-Lite AI Studio
358 t/s
#4
Gemini 2.5 Flash-Lite (AI Studio)Gemini 2.5 Flash-Lite (AI Studio)
352 t/s
#5
Gemini 3.8 Flash (high) AI StudioGemini 3.8 Flash (high) AI Studio
299 t/s

Output speed

Total 59 models

Lowest Price

#1
Gemini 2.5 Flash-Lite (AI Studio)Gemini 2.5 Flash-Lite (AI Studio)
$0.07
#2
Gemini 2.5 Flash-Lite (Non-reasoning) (AI Studio)Gemini 2.5 Flash-Lite (Non-reasoning) (AI Studio)
$0.07
#3
gpt-oss-20b (low) Vertexgpt-oss-20b (low) Vertex
$0.09
#4
gpt-oss-20b (high) Vertexgpt-oss-20b (high) Vertex
$0.09
#5
gpt-oss-120b (high) Vertexgpt-oss-120b (high) Vertex
$0.12

Blended price (per 1M tokens)

Total 59 models

Google offers 59 models, each with different intelligence, performance, and pricing characteristics. Below is a comparison of the key metrics across models.

  • For intelligence, the top models on Google are Claude Opus 5 (max) (51), Claude Fable 5 (with fallback) (50), and Claude Opus 5 (xhigh) (50).
  • For output speed, the fastest models are gpt-oss-20b (high) Vertex (397 t/s), gpt-oss-20b (low) Vertex (362 t/s), and Gemini 3.5 Flash-Lite AI Studio (358 t/s).
  • For latency, Gemini 2.5 Flash-Lite (Non-reasoning) (AI Studio) (0.31s), Gemini 2.5 Flash (Non-reasoning) (AI Studio) (0.44s), and Gemini 2.5 Flash (Non-reasoning) (Vertex) (0.50s) offer the lowest time to first answer token.
  • For pricing, Gemini 2.5 Flash-Lite (AI Studio) ($0.07), Gemini 2.5 Flash-Lite (Non-reasoning) (AI Studio) ($0.07), and gpt-oss-20b (low) Vertex ($0.09) offer the lowest blended prices per 1M tokens.
  • For context window size, Llama 4 Scout Vertex (1M), Claude Opus 5 (max) (1M), and Claude Fable 5 (with fallback) (1M) support the largest context windows on Google.

Highlights

Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens (blended) · Lower is better

Intelligence Evaluations

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3 incorporates 10 evaluations: AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Quantitative analysis on spreadsheets & documents

Agentic tool use

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Context Window

Context Window

Context window: tokens limit · Higher is better

Pricing

Intelligence Index vs. Price

Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Performance Summary

Output Speed vs. Price

Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
Pareto line

Speed

Measured by Output Speed (tokens per second)

Output Speed

Output tokens per second · Higher is better

Latency

Measured by Time (seconds) to First Token

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

End-to-End Response Time

Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed

End-to-End Response Time vs. Price

End-to-end response time: end-to-end seconds to output 500 tokens · USD per 1M tokens (blended)
Most attractive quadrant

Further Analysis
Anthropic logo
Claude Opus 5 (max)
1M
Proprietary
51
$9.38
51
39.41
49.22
--
Anthropic logo
Claude Fable 5 (with fallback)
1M
Proprietary
50
$9.66
58
80.37
88.93
--
Anthropic logo
Claude Opus 5 (xhigh)
1M
Proprietary
50
$7.75
51
30.69
40.55
--
Anthropic logo
Claude Opus 5 (high)
1M
Proprietary
48
$5.64
50
18.08
28.08
--
Anthropic logo
Claude Opus 5 (medium)
1M
Proprietary
45
$3.32
49
4.86
14.97
--
Anthropic logo
Claude Opus 4.8 (max)
1M
Proprietary
42
$5.84
58
15.42
24.09
--
Google logo
Gemini 3.8 Flash (high) AI Studio
1M
Proprietary
41
$1.24
299
16.09
17.76
--
Anthropic logo
Claude Opus 4.7 (max)
1M
Proprietary
41*
--
63
17.20
25.17
--
Google logo
Gemini 3.8 Flash (medium) AI Studio
1M
Proprietary
40
$0.93
--
--
--
--
Anthropic logo
Claude Opus 5 (low)
1M
Proprietary
40
$1.57
48
3.28
13.65
--
Google logo
Gemini 3.7 Flash (medium) AI Studio
1M
Proprietary
40*
--
286
4.95
6.69
--
Google logo
Gemini 3.7 Flash (high) AI Studio
1M
Proprietary
39
$0.93
288
11.87
13.61
--
Anthropic logo
Claude Sonnet 5 (max)
1M
Proprietary
38
$7.36
71
178.12
185.14
--
Google logo
Gemini 3.7 Flash (low) AI Studio
1M
Proprietary
37*
--
272
0.88
2.71
--
Google logo
Gemini 3.6 Flash AI Studio
1M
Proprietary
34
$0.93
179
16.81
19.61
--
Google logo
Gemini 3.8 Flash (low) AI Studio
1M
Proprietary
34
--
--
--
--
--
Google logo
Gemini 3.5 Flash (medium)
1M
Proprietary
34*
--
201
13.34
15.83
--
Google logo
Gemini 3.5 Flash AI Studio
1M
Proprietary
33
$1.56
208
14.93
17.34
--
Anthropic logo
Claude Opus 4.6 (max)
1M
Proprietary
32*
--
40
9.27
21.72
--
Anthropic logo
Claude Sonnet 4.6 (max)
200k
Proprietary
30
$4.13
48
123.50
133.98
--
Google logo
Gemini 3.1 Pro Preview (AI Studio)
1M
Proprietary
30
$0.67
116
26.96
31.25
--
Google logo
Gemini 3.1 Pro Preview (Vertex)
1M
Proprietary
30
$0.98
119
26.00
30.19
--
Anthropic logo
Claude Opus 4.5 Vertex
200k
Proprietary
29*
--
45
19.16
30.32
--
Google logo
Gemini 3 Pro Preview (high) (Vertex)
1M
Proprietary
28*
--
--
--
--
--
Z AI logo
GLM-5
200k
Open
28*
--
76
1.43
48.93
40.92
Anthropic logo
Claude Opus 4.6 (Non-reasoning, high)
1M
Proprietary
26*
--
39
2.59
15.46
--
Google logo
Gemini 3 Flash (AI Studio)
1M
Proprietary
26*
--
200
6.05
8.56
--
Anthropic logo
Claude Sonnet 4.6 (Non-reasoning, high)
200k
Proprietary
25*
--
44
1.96
13.34
--
Google logo
Gemini 3.5 Flash (minimal) AI Studio
1M
Proprietary
24*
--
205
0.91
3.34
--
Anthropic logo
Claude Opus 4.5 (Non-reasoning) Vertex
200k
Proprietary
24*
--
44
1.11
12.41
--
Anthropic logo
Claude 4.1 Opus Vertex
200k
Proprietary
23*
--
--
--
--
--
Google logo
Gemini 3.5 Flash-Lite AI Studio
1M
Proprietary
23
$0.12
358
9.49
10.89
--
Google logo
Gemini 3 Pro Preview (low) (Vertex)
1M
Proprietary
22*
--
--
--
--
--
Z AI logo
GLM-4.7
200k
Open
22*
--
173
0.67
15.14
11.58
Kimi logo
Kimi K2 Thinking Vertex
262k
Open
22*
--
204
0.75
12.99
9.79
Anthropic logo
Claude 4.5 Sonnet Vertex
1M
Proprietary
21
$0.53
39
10.87
23.67
--
Anthropic logo
Claude 4 Opus Vertex
200k
Proprietary
21*
--
--
--
--
--
Anthropic logo
Claude 4.5 Sonnet (Non-reasoning) Vertex
1M
Proprietary
19*
--
38
1.37
14.48
--
MiniMax logo
MiniMax-M2 Vertex
197k
Open
19*
--
140
0.61
18.51
14.32
Anthropic logo
Claude 4.1 Opus (Non-reasoning) Vertex
200k
Proprietary
19*
--
--
--
--
--
Google logo
Gemini 3 Flash (Non-reasoning) (AI Studio)
1M
Proprietary
18*
--
193
0.94
3.53
--
Anthropic logo
Claude 4.5 Haiku Vertex
200k
Proprietary
18
$0.24
89
15.37
20.96
--
Z AI logo
GLM-4.7 (Non-reasoning)
200k
Open
17*
--
155
0.69
3.92
--
Google logo
Gemma 4 26B A4B AI Studio
262k
Open
17*
--
47
1.07
54.49
42.74
Google logo
Gemini 2.5 Pro Vertex
1M
Proprietary
17
$0.23
108
24.26
28.87
--
Google logo
Gemini 2.5 Pro (AI Studio)
1M
Proprietary
17
$0.23
124
23.09
27.12
--
Anthropic logo
Claude 4 Opus (Non-reasoning) Vertex
200k
Proprietary
17*
--
--
--
--
--
Google logo
Gemini 3.1 Flash-Lite (AI Studio)
1M
Proprietary
16
$0.04
281
5.39
7.17
--
Google logo
Gemma 4 31B (AI Studio)
262k
Open
15
$0.00
35
1.00
64.68
49.44
Anthropic logo
Claude 4.5 Haiku (Non-reasoning) Vertex
200k
Proprietary
15*
--
88
0.81
6.50
--
Anthropic logo
Claude 3.7 Sonnet (Non-reasoning) Vertex
200k
Proprietary
15*
--
--
--
--
--
Google logo
Gemini 2.5 Pro (May) (AI Studio)
1M
Proprietary
15*
--
--
--
--
--
DeepSeek logo
DeepSeek V3.1 (Non-reasoning) Vertex
164k
Open
14*
--
--
--
--
--
DeepSeek logo
DeepSeek V3.1 Vertex
164k
Open
13*
--
--
--
--
--
DeepSeek logo
DeepSeek R1 0528 Vertex
164k
Open
13*
--
154
1.05
17.31
13.01
Google logo
Gemini 2.5 Flash (AI Studio)
1M
Proprietary
13*
--
223
23.47
25.71
--
Google logo
Gemini 2.5 Flash (Vertex)
1M
Proprietary
13*
--
187
22.57
25.25
--
OpenAI logo
gpt-oss-120b (high) Vertex
131k
Open
12
$0.06
170
0.64
15.31
11.73
Alibaba logo
Qwen3 235B 2507 Vertex
262k
Open
12*
--
92
0.77
6.23
--
Alibaba logo
Qwen3 Coder 480B Vertex
262k
Open
12*
--
155
0.78
4.00
--
Alibaba logo
Qwen3 Next 80B A3B (Reasoning) Vertex
262k
Open
11*
--
131
0.66
19.72
15.25
Google logo
Gemini 2.5 Flash-Lite (Sep) (AI Studio)
1M
Proprietary
10*
--
--
--
--
--
OpenAI logo
gpt-oss-120b (low) Vertex
131k
Open
10*
--
154
0.51
16.72
12.96
OpenAI logo
gpt-oss-20b (low) Vertex
131k
Open
10*
--
362
0.32
7.23
5.52
Google logo
Gemini 2.5 Flash (Non-reasoning) (Vertex)
1M
Proprietary
10*
--
149
0.50
3.87
--
Google logo
Gemini 2.5 Flash (Non-reasoning) (AI Studio)
1M
Proprietary
10*
--
198
0.44
2.97
--
Alibaba logo
Qwen3 Next 80B A3B Vertex
262k
Open
10*
--
275
0.59
2.41
--
Google logo
Gemini 2.5 Flash-Lite (Sep) (Non-reasoning) (AI Studio)
1M
Proprietary
9*
--
--
--
--
--
OpenAI logo
gpt-oss-20b (high) Vertex
131k
Open
9
$0.01
397
0.36
6.65
5.03
Google logo
Gemini 2.5 Flash-Lite (AI Studio)
1M
Proprietary
9*
--
352
20.34
21.77
--
Google logo
Gemini 2.0 Flash (exp) (AI Studio)
1M
Proprietary
8*
--
--
--
--
--
Meta logo
Llama 3.3 70B Vertex
128k
Open
8*
--
139
0.64
4.23
--
Google logo
Gemini 2.5 Flash-Lite (Non-reasoning) (AI Studio)
1M
Proprietary
7*
--
280
0.31
2.10
--
Meta logo
Llama 4 Scout Vertex
1.31M
Open
6
$0.16
147
0.71
4.10
--
Google logo
Gemma 3 27B (AI Studio)
128k
Open
5
$0.00
--
--
--
--
Google logo
Gemma 3 4B (AI Studio)
128k
Open
5*
--
--
--
--
--
Google logo
Gemma 3n E2B (AI Studio)
32k
Open
5*
--
--
--
--
--
Google logo
Gemma 3 1B (AI Studio)
32k
Open
5*
--
--
--
--
--
Google logo
Gemma 3 12B (AI Studio)
128k
Open
4
$0.00
--
--
--
--

Key definitions

Frequently Asked Questions

Common questions about Google