Skip to content

Available Models

72 models across 12 providers, plus 9 smart-routing aliases. Live pricing at api.jarvisclaw.ai/pricing.

Query the live list

GET /v1/models is authoritative. The tables below are a snapshot and models are added and retired regularly.

Smart Routing

RouteDescription
autoBest overall model (balances quality/cost/speed)
auto/premiumHighest quality available
auto/ecoCheapest capable model
auto/freeFree models only (Nvidia hosted)
auto/imageBest image generation model
auto/videoBest video generation model
auto/ttsBest text-to-speech model
auto/musicBest music generation model
auto/searchWeb search with citations

Free Models (Nvidia Hosted)

Unlimited usage, no cost.

ModelContextTags
nvidia/qwen3.5-122b-a10b131Kchat, reasoning, coding
nvidia/qwen3-next-80b-a3b-instruct262Kchat, reasoning, coding
nvidia/step-3.7-flash131Kchat, reasoning
nvidia/nemotron-nano-12b-v2-vl131Kchat, reasoning, vision
nvidia/seed-oss-36b131Kchat, coding
nvidia/mistral-large-3-675b131Kchat, reasoning, coding
nvidia/llama-4-maverick131Kchat, reasoning, coding
nvidia/nemotron-nano-9b-v2131Kchat, reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning256Kchat, reasoning, vision
nvidia/mistral-nemotron131Kchat, coding

Chat & Reasoning Models

Pricing uses a ratio system. Input price is ratio × $2 per 1M tokens. Output price is input price × completion ratio, where the completion ratio is per-model — it ranges from 2× to roughly 8.3× and is not a flat 3×. Both figures come back from api.jarvisclaw.ai/pricing.

ModelContextRatioCompletionTags
openai/gpt-5.51050K2.5chat, reasoning, coding, vision
openai/gpt-5.4-pro1050K15chat, reasoning, coding, vision
openai/gpt-5.41050K1.25chat, reasoning, coding, vision
openai/gpt-5.4-mini400K0.375chat, coding, vision
openai/gpt-5.4-nano1050K0.16.25×chat
openai/gpt-5.3-codex400K0.875coding, reasoning, chat
openai/gpt-5.3128K0.875chat, reasoning, coding, vision
openai/gpt-5.2-pro400K10.5chat, reasoning, coding, vision
openai/gpt-5.2400K0.875chat, reasoning, coding, vision
openai/gpt-5-mini200K0.125chat, coding
openai/gpt-4.1128K1chat, coding, vision
openai/gpt-4.1-mini128K0.2chat, coding
openai/gpt-4.1-nano128K0.05chat
openai/gpt-4o128K1.25chat, coding, vision
openai/gpt-4o-mini128K0.075chat, coding
openai/o3200K1chat, reasoning, coding
openai/o3-mini128K0.55chat, reasoning, coding
openai/o1200K7.5chat, reasoning, coding
openai/o4-mini128K0.55reasoning, coding
anthropic/claude-opus-4.81000K2.5chat, coding, reasoning, vision
anthropic/claude-opus-4.71000K2.5chat, coding, reasoning, vision
anthropic/claude-opus-4.5200K2.5chat, coding, reasoning, vision
anthropic/claude-sonnet-4.6200K1.5chat, coding, reasoning
anthropic/claude-sonnet-4.5200K1.5chat, coding, reasoning, vision
anthropic/claude-haiku-4.5200K0.5chat, coding
google/gemini-3.5-flash1048K0.25chat, reasoning, coding, vision
google/gemini-3.1-pro1048K1chat, reasoning, coding, vision
google/gemini-3.1-flash-lite1048K0.125chat, reasoning
google/gemini-3-flash-preview1048K0.25chat, reasoning, coding, vision
google/gemini-2.5-pro1048K0.625chat, reasoning, coding, vision
google/gemini-2.5-flash1048K0.158.33×chat, coding, vision
google/gemini-2.5-flash-lite1048K0.05chat
deepseek/deepseek-chat1048K0.1chat, coding
deepseek/deepseek-reasoner1048K0.1chat, reasoning, coding
deepseek/deepseek-v4-pro1048K0.2175chat, reasoning, coding
xai/grok-4.31000K0.752.67×reasoning, coding, vision, chat
xai/grok-build-0.1256K0.75coding, chat
moonshot/kimi-k2.7262K0.4754.21×chat, reasoning, coding, vision
minimax/minimax-m31048K0.15chat, reasoning, coding
minimax/minimax-m2.7204K0.15chat, reasoning, coding
zai/glm-5.21000K0.73.14×chat, reasoning, coding
zai/glm-5.1200K0.73.14×chat, reasoning, coding
zai/glm-5200K0.33.2×chat, reasoning, coding
zai/glm-5-turbo200K0.63.33×chat, reasoning

Image Generation Models

Flat per-image pricing at the default 1024×1024. Larger sizes cost more — see Image Generation for the per-size table.

ModelPrice/imageNotes
openai/gpt-image-1$0.021Standard quality
openai/gpt-image-2$0.063Higher quality
google/nano-banana$0.053Artistic generation
google/nano-banana-pro$0.105Premium quality
zai/cogview-4$0.015Budget option
xai/grok-imagine-image$0.021xAI generation
xai/grok-imagine-image-pro$0.074xAI premium

Video Generation Models

Video is priced per second, not per clip

Multiply by your requested duration. A 5-second seedance-2.0 clip at 720p costs 5 × $0.227 ≈ $1.14, not $0.227. Higher resolutions cost more again — see Video Generation for the resolution multipliers.

ModelPrice/secondNotes
bytedance/seedance-2.5$0.315Newest generation, up to 30s, no RealFace
bytedance/seedance-2.0$0.227Up to 4K, supports RealFace
bytedance/seedance-2.0-fast$0.165Fast generation, supports RealFace
bytedance/seedance-1.5-pro$0.070Image-to-video only
azure/sora-2$0.10720p + audio, 4/8/12s durations only
xai/grok-imagine-video$0.05xAI video

Audio Models

TTS is billed per 1,000 characters of input.

ModelTypePriceNotes
elevenlabs/flash-v2.5TTS$0.05/1k charsFast speech synthesis (~75ms latency)
elevenlabs/turbo-v2.5TTS$0.05/1k charsBalanced quality and latency
elevenlabs/multilingual-v2TTS$0.12/1k charsMulti-language support
elevenlabs/v3TTS$0.12/1k charsHighest quality
elevenlabs/sound-effectsSFX$0.12/1k charsSound effect generation
minimax/music-2.5+Music$0.1575/trackUp to ~3 min

Providers

IDProviderModels
1OpenAI21
2Anthropic6
3Google9
4DeepSeek3
5Moonshot1
6ZAI (智谱)5
7xAI5
8MiniMax3
9Nvidia10 (all free)
10ElevenLabs5
11ByteDance3
12Azure1

Prices shown are reference rates

The settled amount for a given call can differ slightly. Every response carries a price object with the exact amount charged — read that rather than this table.

Full pricing details and live availability at api.jarvisclaw.ai/pricing.