ant:balancedEven speed and quality, with a quality floor of 60.
ant:balanced is ant:auto with a guard rail: models scoring below 60 are excluded outright. Reach for it when you want sensible defaults but cannot tolerate the bottom of the catalog.
Live routing over the last 30 days
Requests
167
Success rate
49.1%
Avg latency
784ms
364 models across 16 providers currently qualify. Per-request limits (context size, cost caps, your model allowlist) narrow this further at routing time.
o1-pro
o1-pro
o3
o3
Claude Sonnet 5
Anthropic: Claude Opus 5.5 (batch)
Anthropic: Claude Opus 4.1
Anthropic: Claude Opus 5 (batch)
Anthropic: Claude Opus 4.8
Anthropic: Claude Opus 4.6 (batch)
OpenAI: o3 Mini High
Anthropic: Claude Opus 4.8 (batch)
Anthropic: Claude Opus 4.5
Anthropic: Claude Opus 4.1 (batch)
o1
o1
OpenAI: o4 Mini High
GPT-5
Anthropic: Claude Opus 4.7
Anthropic: Claude Opus 5
Anthropic: Claude Opus 4.6
Anthropic: Claude Opus Latest
Anthropic: Claude Opus 5.5
Anthropic: Claude Opus 4.5 (batch)
Showing the 24 highest-scoring of 364.
from openai import OpenAI
client = OpenAI(
base_url="https://api.antbase.ai/v1",
api_key="YOUR_ANT_API_KEY",
)
response = client.chat.completions.create(
model="ant:balanced",
messages=[{"role": "user", "content": "Hello!"}]
)
print(response.choices[0].message.content)Every virtual pool accepts the same request shape — swap the model id to change the routing policy.
Browse all virtual models →