Google model benchmarks.

Compare Google models across answer quality, coding, complex tasks, speed, price, and context size.

Google

Quality

Highest overall scores

  1. 1Google: Gemini 3.5 Flash50.2
  2. 2Google: Gemini 3.6 Flash50.1
  3. 3Google Gemini Pro Latest0

Response speed

Fastest output in this sample

  1. 1Google: Gemini 3.6 Flash148 t/s
  2. 2Google: Gemini 3.5 Flash119 t/s
  3. 3Google Gemini Pro Latest0 t/s

Input price

Lowest price per 1M tokens

  1. 1Google: Gemini 3.5 Flash$1.50/1M
  2. 2Google: Gemini 3.6 Flash$1.50/1M
  3. 3Google Gemini Pro Latest$2.00/1M

Highlights

Quality

Overall capability · Higher is better

Speed

Output tokens per second · Higher is better

Input price

USD per 1M tokens · Lower is better

Quality benchmarks

Compare Google model capability.

Performance and price

Compare practical tradeoffs.

All Google models.

3 models in the current catalogue.

Google technical benchmarks.

Compare named evaluation records available for Google models. Missing results remain blank rather than being estimated.

BenchmarkAreaGemini 3.5 FlashGemini 3.6 FlashGoogle Gemini Pro LatestSource
Intelligence IndexoverallQuality50.250.1OpenRouter / artificial-analysis
Coding Indexcoding70.169.2OpenRouter / artificial-analysis
Agentic Indexagentic37.438.7OpenRouter / artificial-analysis
GPQAGPQA Diamond92.292.8OpenRouter model benchmarks
Humanity's Last ExamHLE4138.3OpenRouter model benchmarks
IFBenchIFBench76.3OpenRouter model benchmarks
τ²-Bench Telecomτ²-Bench Telecom95.3OpenRouter model benchmarks
AA-LCRAA-LCR69.369.7OpenRouter model benchmarks
GDPval-AAGDPval-AA42.246.2OpenRouter model benchmarks
CritPtCritPt13.110.6OpenRouter model benchmarks
SciCodeSciCode53.152.7OpenRouter model benchmarks
Terminal-Bench HardTerminal-Bench Hard40.9OpenRouter model benchmarks
AA-Omniscience AccuracyAA-Omniscience Accuracy51.950.2OpenRouter model benchmarks
AA-Omniscience Non-Hallucination RateAA-Omniscience Non-Hallucination Rate39.346.5OpenRouter model benchmarks