Head to head
OpenAI: GPT-5.6 Luna vs Google: Gemini 3.7 Flash
Live prices, context windows, capabilities, and measured quality — updated continuously.
Side by side
| Metric | OpenAI: GPT-5.6 Luna Openai | Google: Gemini 3.7 Flash Google |
|---|---|---|
| Input $/M tokens | $0.200 | $0.375 |
| Output $/M tokens | $1.20 | $1.88 |
| Context window | 1.1M | 1.0M |
| Max output | 128K | 66K |
| WM Score | 87 | 88 |
| Benchmark quality | 83.7 | 87 |
| Hosts serving it | 3 | 2 |
| Throughput (tok/s) | 111 | 201 |
| Latency (ms) | 979 | 1846 |
| Vision | ||
| Tools | ||
| Reasoning | ||
| JSON mode |
Which should you pick?
OpenAI: GPT-5.6 Luna costs less per million input tokens — about 1.9× cheaper than Google: Gemini 3.7 Flash. Google: Gemini 3.7 Flash scores higher on measured quality. OpenAI: GPT-5.6 Luna takes a larger context window, which matters for long documents or big codebases. Prices here are live list prices; the same model can cost less on a different host, so check the model page for the cheapest offering.
