← comparisons · head to head

Claude Haiku 5.5 vs Gemini 3.8 Flash

Of the 4 public leaderboards that rate both, Claude Haiku 5.5 scores higher on 2 and Gemini 3.8 Flash on 2. On the ArtificialWatch Index, which takes the median of each model's percentile across the boards that score it, Claude Haiku 5.5 is at 50.2 and Gemini 3.8 Flash at 47.1 (out of 100).

Scores as published by each board; table composed October 8, 2026.

Get the next launch alert, free →

Leaderboard by leaderboard

BoardClaude Haiku 5.5Gemini 3.8 FlashHigher
LMArena
Elo (community votes)
1,586.91,583.5Claude Haiku 5.5
LiveBench
global average (0-100)
72.175.8Gemini 3.8 Flash
Vals AI
Vals Index accuracy % · weighted finance + coding tasks
54.354.8Gemini 3.8 Flash
Artificial Analysis
intelligence index · measured runs only
43.440.9Claude Haiku 5.5

Raw scores are each board's own scale, so compare within a row, not across rows. Full table: the bench index.

For coding

On the ArtificialWatch coding index, Claude Haiku 5.5 is at 73.5 (#11 of 35) and Gemini 3.8 Flash at 47.1 (#18). Claude Haiku 5.5 scores higher on all 2 coding boards that rate both.

Coding boardClaude Haiku 5.5Gemini 3.8 Flash
LiveBench · Coding67.563.4
Vals Vibe Code Bench90.478.7

The full AI coding leaderboard →

Claude Haiku 5.5 at a glance

Developer
Anthropic
Status
Live since October 7, 2026
API price
$0.10 input / $0.50 output per 1M tokens · Anthropic, claude-haiku-5-5
Context window
1M tokens

Live — Oct 7 · $0.10/$0.50 per MTok for prompts up to 100K tokens, $0.50/$2.50 above · cache reads $0.01 / $0.05 · 1M ctx / 128K out · knowledge cutoff Jun 2026 · in the API, the Claude apps, AWS, Google Cloud and Microsoft Foundry the same day · Anthropic's own table: OSWorld 2.1 72.4% (GPT-6 Luna 48.9%, Haiku 4.5 15.7%), Terminal-Bench 4.0 39.2% (Luna 16.4%) · Artificial Analysis Intelligence Index 43 at max effort, #2 of 179 in its price tier (read Oct 7) · our sweep fired on claude-haiku-5-5 at 17:52 UTC, OpenRouter listed it at 18:31.

Claude Haiku 5.5 is out at $0.10 / $0.50, a tenth of Haiku 4.5's price

2026-10-07 · Anthropic released Claude Haiku 5.5 on October 7 as claude-haiku-5-5, on the Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry and in the Claude apps.

Full Claude Haiku 5.5 tracker →

Gemini 3.8 Flash at a glance

Developer
Google
Status
Live since September 2, 2026
API price
$0.75 input / $3.75 output per 1M tokens · Google, gemini-3.8-flash
Context window
1.05M tokens

Live — GA Sep 2 · $0.75/$3.75 per 1M introductory through Dec 31, identical to 3.7 · 1M in / 64K out · 'our most intelligent Flash model' · 20 days after 3.7.

Gemini 3.8 Flash is GA — same price as 3.7, twenty days later

2026-09-02 · Google released Gemini 3.8 Flash today. The Gemini API changelog for September 2 reads: "Gemini 3.8 Flash generally available (GA): Released gemini-3.8-flash, our most intelligent Flash model, engineered for long-horizon software engineering, autonomous agents, and complex enterprise workflows."

Full Gemini 3.8 Flash tracker →

Claude Haiku 5.5 vs Gemini 3.8 Flash: quick answers

Which is better, Claude Haiku 5.5 or Gemini 3.8 Flash?

It depends on what you measure. Of the 4 public leaderboards that rate both, Claude Haiku 5.5 scores higher on 2 and Gemini 3.8 Flash on 2. Claude Haiku 5.5's widest lead is on Artificial Analysis; Gemini 3.8 Flash's widest lead is on LiveBench. On the ArtificialWatch Index, which takes the median of each model's percentile across the boards that score it, Claude Haiku 5.5 is at 50.2 and Gemini 3.8 Flash at 47.1 (out of 100).

Which is newer, Claude Haiku 5.5 or Gemini 3.8 Flash?

Claude Haiku 5.5. It went live on October 7, 2026, 35 days after Gemini 3.8 Flash (September 2, 2026).

Which is cheaper, Claude Haiku 5.5 or Gemini 3.8 Flash?

Claude Haiku 5.5 is cheaper on both input and output. On each vendor's own API, Claude Haiku 5.5 is $0.10 input / $0.50 output per million tokens and Gemini 3.8 Flash is $0.75 input / $3.75 output per million tokens. Claude Haiku 5.5's rate rises for prompts over 100K tokens. Prices as published in the models.dev catalog, as of 2026-10-08.

Which has the bigger context window, Claude Haiku 5.5 or Gemini 3.8 Flash?

Gemini 3.8 Flash, at 1.05M tokens against Claude Haiku 5.5's 1M, as each vendor lists it.

How do Claude Haiku 5.5 and Gemini 3.8 Flash compare for coding?

On the ArtificialWatch coding index, Claude Haiku 5.5 is at 73.5 (#11 of 35) and Gemini 3.8 Flash at 47.1 (#18). Claude Haiku 5.5 scores higher on all 2 coding boards that rate both.

Who makes Claude Haiku 5.5 and Gemini 3.8 Flash?

Claude Haiku 5.5 is from Anthropic; Gemini 3.8 Flash is from Google.

Where do these numbers come from?

Each score is the leaderboard's own published figure, read by ArtificialWatch (table composed October 8, 2026). Boards measure different things, so raw scores are only comparable within a row.

More comparisons

GPT-6 Astra vs Claude Fable 5.1GPT-6 Astra vs GPT-5.6GPT-6 Astra vs Claude Opus 5Claude Fable 5.1 vs Claude Fable 5Claude Fable 5.1 vs Claude Opus 5Claude Opus 5 vs GPT-5.6Claude Opus 5 vs Claude Opus 4.8Claude Opus 5 vs Claude Fable 5Claude Opus 5 vs Kimi K3Kimi K3 vs Claude Fable 5Kimi K3 vs GLM-5.2Kimi K3 vs GPT-5.6DeepSeek V4 Pro vs GLM-5.2DeepSeek V4 Pro vs Kimi K3Grok 4.7 vs GPT-6 AstraGrok 4.7 vs Claude Opus 5Grok 4.7 vs Claude Fable 5.1Qwen 3.8 Max vs Claude Opus 5Qwen 3.8 Max vs Claude Fable 5Qwen 3.8 Max vs Kimi K3Qwen 3.8 Max vs DeepSeek V4 ProQwen 3.8 Max vs GLM-5.2Qwen 3.8 Max vs GPT-5.6GPT-6 Astra vs Claude Fable 5Claude Fable 5 vs Claude Opus 4.8Claude Fable 5 vs Claude Sonnet 5Claude Sonnet 5 vs Claude Opus 4.8Claude Sonnet 5 vs Claude Opus 5GLM-5.2 vs Claude Opus 4.8GLM-5.2 vs Claude Fable 5GLM-5.2 vs GPT-5.5Gemini 3.5 Flash vs Gemini 3.1 ProGemini 3.5 Flash vs Claude Sonnet 5GPT-6 Astra vs Claude Opus 4.8Claude Fable 5.1 vs Claude Opus 4.8Kimi K3 vs Claude Opus 4.8DeepSeek V4 Pro vs Claude Opus 4.8DeepSeek V4 Pro vs GPT-5.5DeepSeek V4 Pro vs Claude Fable 5GLM-5.3 vs Kimi K3GLM-5.3 vs GLM-5.2GLM-5.3 vs GPT-6 AstraGrok 4.6 vs Claude Opus 5Grok 4.6 vs Claude Fable 5Grok 4.6 vs GPT-5.6Grok 4.6 vs Grok 4.5Grok 4.6 vs Claude Sonnet 5Gemini 3.8 Flash vs Gemini 3.1 ProGemini 3.8 Flash vs Claude Opus 5Muse Spark 1.3 vs Gemini 3.8 FlashMuse Spark 1.3 vs GLM-5.3GPT-6 Sol vs GPT-6 AstraGPT-6 Sol vs Claude Opus 5GPT-6 Sol vs Claude Fable 5GPT-6 Luna vs GPT-6 AstraGPT-6 Sol vs GPT-6 LunaClaude Fable 5 vs GPT-5.6Claude Opus 4.8 vs GPT-5.5GPT-5.6 vs Claude Opus 4.8GPT-5.6 vs Claude Sonnet 5Claude Sonnet 5 vs GPT-5.5Claude Fable 5 vs GPT-5.5DeepSeek V4 Pro vs Claude Opus 5Qwen 3.8 Max vs GLM-5.3Qwen 3.8 Max vs Claude Opus 4.8GLM-5.3 Flash vs GLM-5.3GLM-5.3 Flash vs GLM-5.2MiniMax M3 vs Kimi K3MiniMax M3 vs DeepSeek V4 ProMiniMax M3 vs GLM-5.2MiniMax M3 vs GPT-5.5GLM-5.3 vs DeepSeek V4 ProGLM-5.3 vs Claude Opus 5GLM-5.3 vs Claude Fable 5Kimi K3 vs DeepSeek V4.1 FlashGrok 4.7 vs Grok 4.6Muse Spark 1.3 vs Claude Fable 5.1Muse Spark 1.3 vs Claude Opus 5Muse Spark 1.3 vs DeepSeek V4.1 FlashMuse Spark 1.3 vs Grok 4.6Muse Spark 1.3 vs GPT-6 AstraGemini 3.8 Flash vs GPT-6 AstraGemini 3.8 Flash vs Claude Fable 5.1Gemini 3.8 Flash vs Claude Sonnet 5Gemini 3.8 Flash vs Grok 4.6Gemini 3.8 Flash vs GPT-5.6GPT-5.6 vs GPT-5.5Claude Sonnet 5.5 vs Claude Opus 5.5Claude Haiku 5.5 vs Claude Sonnet 5.5Claude Sonnet 5.5 vs Claude Sonnet 5Claude Sonnet 5.5 vs GPT-6.1 SolClaude Sonnet 5.5 vs Claude Opus 5Claude Sonnet 5.5 vs Claude Opus 4.8GPT-6.1 Sol vs GPT-6 AstraGPT-6.1 Sol vs Claude Opus 5.5GPT-6.1 Sol vs GPT-5.6GPT-6.1 Sol vs GPT-6 SolClaude Haiku 5.5 vs GPT-6 LunaClaude Haiku 5.5 vs Claude Opus 5.5Claude Haiku 5.5 vs Claude Sonnet 5Claude Opus 5.5 vs Claude Fable 5.1Claude Opus 5.5 vs GPT-6 AstraClaude Opus 5.5 vs Claude Opus 5Mistral Large 4 vs Claude Opus 5.5GPT-6 Luna vs Claude Sonnet 5.5GPT-6 Luna vs GPT-6.1 SolClaude Fable 5.1 vs Claude Sonnet 5.5Gemini 3.8 Flash vs GLM-5.3 Flash
sweeping every 60 seconds

Hear the minute the next one drops. Free.

A free Chrome push the moment a new model answers on a public API, an email about 15 minutes later. Texts or a phone call on paid plans.

  • Free forever
  • No card
  • Unsubscribe in one click

Also: the bench index · API pricing · the wire