Skip to content

Supported Models

Complete list of AI models available through GateFlow.

Chat Models

OpenAI

ModelContextQualityInput $/1MOutput $/1MBest For
gpt-5.2128k10/10$1.75$14.00Complex reasoning, best balanced
gpt-5.2-codex128k10/10$1.75$14.00Code generation
gpt-5128k9/10$0.50$4.00General purpose with vision
gpt-5-mini128k8/10$0.15$0.60Fast, cost-effective
gpt-5-nano128k7/10$0.10$0.40Simple Q&A, best value
gpt-4.1128k9/10$0.60$1.80Legacy, code-optimized
o3128k10/10$10.00$40.00Advanced reasoning
o4-mini128k9/10$3.00$12.00Fast reasoning

Anthropic

ModelContextQualityInput $/1MOutput $/1MBest For
claude-opus-4-5-20251107200k10/10$15.00$75.00Complex analysis, vision
claude-opus-4-1-20250805200k10/10$15.00$75.00Code, reasoning
claude-sonnet-4-5-20250929200k9/10$3.00$15.00Code, vision, balanced
claude-haiku-4-5-20251015200k8/10$0.25$1.25Fast, cost-effective

No Embeddings

Anthropic does not provide embedding models. Use OpenAI, Google, Cohere, or Mistral for embeddings.

Google

ModelContextQualityInput $/1MOutput $/1MBest For
gemini-3-pro2M9/10$1.25$5.00Complex reasoning, vision
gemini-3-flash1M9/10$0.10$0.40Fast, coding, vision
gemini-3-deep-think1M10/10$3.50$14.00Advanced reasoning
gemini-2.5-pro1M9/10$1.00$4.00General purpose
gemini-2.5-flash1M8/10$0.075$0.30Fast, vision, best value
gemini-2.5-flash-lite512k7/10$0.025$0.10Cheapest

Mistral

ModelContextQualityInput $/1MOutput $/1MBest For
mistral-large-3128k9/10$2.00$6.00Complex reasoning
mistral-small-3128k8/10$0.20$0.60General purpose
ministral-8b128k7/10$0.10$0.30Simple Q&A
ministral-3b128k6/10$0.04$0.04Cheapest
pixtral-large-latest128k8/10$0.40$1.20Vision tasks
devstral-2128k9/10$0.40$2.00Code (SWE-bench: 72.2%)
devstral-small-2128k8/10$0.20$1.00Fast code tasks

Cohere

ModelContextOutputInput $/1MOutput $/1M
command-r-plus128k4,096$2.50$10.00
command-r-plus-08-2024128k4,096$2.50$10.00
command-r128k4,096$0.15$0.60
command-r-03-2024128k4,096$0.15$0.60

Reasoning Models

ModelProviderContextOutputInput $/1MOutput $/1M
o3OpenAI200k100,000$10.00$40.00
o4-miniOpenAI128k65,536$1.10$4.40

Embedding Models

ModelProviderDimensionsMax Tokens$/1M Tokens
text-embedding-3-largeOpenAI3,0728,191$0.13
text-embedding-3-smallOpenAI1,5368,191$0.02
text-embedding-004Google7682,048$0.025
embed-english-v3.0Cohere1,024512$0.10
embed-multilingual-v3.0Cohere1,024512$0.10
embed-english-light-v3.0Cohere384512$0.05
embed-multilingual-light-v3.0Cohere384512$0.05
mistral-embedMistral1,0248,192$0.10

Audio Models

Speech-to-Text

ModelProviderLanguages$/minute
whisper-1OpenAI50+$0.006
voxtral-mini-latestMistral100+$0.02
voxtral-mini-2602Mistral100+$0.02
gemini-2.5-flashGoogle100+Audio via chat API
gemini-2.5-proGoogle100+Audio via chat API

Text-to-Speech

ModelProviderVoices$/1M chars
tts-1OpenAI6$15.00
tts-1-hdOpenAI6$30.00
eleven_multilingual_v2ElevenLabs100+$24.00
eleven_turbo_v2_5ElevenLabs100+$12.00
eleven_flash_v2_5ElevenLabs100+$6.00
eleven_monolingual_v1ElevenLabs6$18.00

ElevenLabs Voice IDs

Voice NameVoice ID
Rachel21m00Tcm4TlvDq8ikWAM
JoshTxGEqnHWrfWFTfGW9XjX
BellaEXAVITQu4vr4xnSDxMaL
AdampNInz6obpgDQGcFmaJgB
AntoniErXwobaYiN019PkySvjV
DomiAZnzlk1XvdvUeBnXmlld
FinD38z5RcWu1voky8WS1ja

Reranking Models

ModelProvider$/1k searches
rerank-english-v3.0Cohere$1.00
rerank-multilingual-v3.0Cohere$1.00

OCR Models

ModelProvider$/page
mistral-ocr-latestMistral$0.01

Model Capabilities

Vision Support

Models that accept image inputs:

  • gpt-5.2 | gpt-5.2-codex | gpt-5 | gpt-5-mini
  • claude-opus-4-5 | claude-sonnet-4-5 | claude-haiku-4-5
  • gemini-3-pro | gemini-3-flash | gemini-2.5-pro | gemini-2.5-flash
  • pixtral-large-latest

Function Calling

Models that support tool use:

  • All OpenAI GPT-5 and o-series models
  • All Anthropic Claude 4 models
  • All Gemini 2.5+ models
  • mistral-large-3 | mistral-small-3

JSON Mode

Models with structured JSON output:

  • All OpenAI models
  • All Anthropic models
  • All Gemini models
  • All Mistral models

Streaming

All chat models support streaming responses.

Model Comparison

Best for Code

  1. devstral-2 - Purpose-built for code
  2. gpt-5.2-codex - Excellent code understanding
  3. claude-sonnet-4-5 - Strong code generation

Best for Long Context

  1. gemini-3-pro - 2M tokens
  2. claude-opus-4-5 - 200k tokens
  3. gpt-5.2 - 256k tokens

Best for Cost

  1. gemini-2.5-flash-lite - $0.025/1M input
  2. ministral-3b - $0.04/1M input
  3. gpt-5-nano - $0.05/1M input

Best for Quality

  1. claude-opus-4-5 - Highest capability
  2. gpt-5.2 - Excellent all-around
  3. gemini-3-pro - Strong reasoning

Best for Reasoning

  1. o3 - Advanced reasoning
  2. o4-mini - Fast reasoning
  3. claude-opus-4-5 - Complex analysis

Deprecated Models

ModelProviderSunset DateReplacement
gpt-4-turboOpenAI2025-09-01gpt-5
gpt-4OpenAI2025-06-01gpt-5-mini
gpt-3.5-turboOpenAI2025-03-01gpt-5-nano
claude-3-opus-20240229Anthropic2025-12-01claude-opus-4-5
gemini-1.5-proGoogle2026-03-01gemini-2.5-pro
mistral-mediumMistral2025-06-01mistral-small-3
text-embedding-ada-002OpenAI2025-06-01text-embedding-3-small
rerank-english-v2.0Cohere2025-06-01rerank-english-v3.0
textembedding-geckoGoogle2025-03-01text-embedding-004

GateFlow automatically falls back to replacement models. See Model Change Management.

Model Aliases

GateFlow provides convenient aliases:

AliasResolves To
gpt-5-latestgpt-5.2
claude-opusclaude-opus-4-5-20251107
claude-sonnetclaude-sonnet-4-5-20250929
claude-haikuclaude-haiku-4-5-20251015
gemini-progemini-3-pro
gemini-flashgemini-3-flash

You can create custom aliases in the dashboard.

Requesting Models

Need a model not listed? Contact us to request new model support.

Pricing Notes

  • Prices shown are GateFlow pass-through rates
  • No markup on provider pricing
  • Cached responses are free
  • Volume discounts available for Enterprise

Built with reliability in mind.