Model overview
TextVisionToolsStructured outputContext cacheGemini 2.5 Pro is Google Vertex AI's stable Pro model for higher-quality reasoning, analysis, coding, and multimodal tasks.
Company: GoogleProvider: Google Vertex AI
Model capabilities
Input modalityT
Output modalityT
Text generation✓
Vision✓
Function calling✓
Structured output✓
Context cache✓
Batch inference✓
Fine-tuning×
Model pricing
Input (up to 200K context)$1.25/1M tokens
Input cache hit (up to 200K context)$0.13/1M tokens
Output (up to 200K context)$10/1M tokens
Input (over 200K context)$2.50/1M tokens
Input cache hit (over 200K context)$0.25/1M tokens
Output (over 200K context)$15/1M tokens
Rate limits and context
Context window1M tokens
Maximum output65,535 tokens
Serving locationglobal
API reference
EndpointPOST /v1/chat/completions
SDKOpenAI-compatible
API code examples
from openai import OpenAI client = OpenAI( api_key="$WLROUTER_API_KEY", base_url="https://api.wlrouter.com/v1" ) response = client.chat.completions.create( model="gemini-2.5-pro", messages=[ {"role": "user", "content": "Reply with one short sentence."} ], max_tokens=32 ) print(response.choices[0].message.content)