Models/Gemini 2.5 Pro
Model Code
gemini-2.5-pro
Try now

Model overview

TextVisionToolsStructured outputContext cache

Gemini 2.5 Pro is Google Vertex AI's stable Pro model for higher-quality reasoning, analysis, coding, and multimodal tasks.

Company: GoogleProvider: Google Vertex AI

Model capabilities

Input modalityT
Output modalityT
Text generation
Vision
Function calling
Structured output
Context cache
Batch inference
Fine-tuning×

Model pricing

Input (up to 200K context)$1.25/1M tokens
Input cache hit (up to 200K context)$0.13/1M tokens
Output (up to 200K context)$10/1M tokens
Input (over 200K context)$2.50/1M tokens
Input cache hit (over 200K context)$0.25/1M tokens
Output (over 200K context)$15/1M tokens

Rate limits and context

Context window1M tokens
Maximum output65,535 tokens
Serving locationglobal

API reference

EndpointPOST /v1/chat/completions
SDKOpenAI-compatible

API code examples

Get API Key
from openai import OpenAI

client = OpenAI(
    api_key="$WLROUTER_API_KEY",
    base_url="https://api.wlrouter.com/v1"
)

response = client.chat.completions.create(
    model="gemini-2.5-pro",
    messages=[
        {"role": "user", "content": "Reply with one short sentence."}
    ],
    max_tokens=32
)

print(response.choices[0].message.content)