All models

gemini-3.7-flash

gemini-3.7-flash

Pricing

Input
$0.750 / M
Output
$3.75 / M
Cached input
$0.075 / M
Cache write
—
Cache write (1h)
—
Currency
USD

Cents per million tokens. Every buffered reply carries X-Nozzle-Cost-Micro-Cents; streaming replies reconcile by request id.

Facts

Model id
gemini-3.7-flash
Family
vertex_ai-language-models
Modality
text
Provider
gemini
Upstream id
gemini-3.7-flash
Context window
1.0M
Max output tokens
unpublished
Parameters
—
License
—
Wire
openai_chat

Capabilities the router will accept

toolstool_choice_namedjson_objectjson_schemavisionaudio_inpdf_invideo_inreasoningstreamingn_gt_1seedpenalties