Docs/Models

Models

Every model on askr, what it costs, and where it runs.

Checked against the code on

This list is the live catalog, read when the page loads and cached for five minutes. Ids are exact and are what you pass as model. Prices are per million tokens for chat, per picture or per clip for media.

317 chat models on the API, 3 of them make pictures. 21 video models in the workspace. 153 listed but not routable.

7
ModelIdRuns onIn / out, $ per 1MTurnContext
ByteDance 7
UI-TARS 7Bbytedance/ui-tars-1.5-7bAPI, workspace0.105 / 0.2110.21 cr128K
Seed 1.6 Flashbytedance-seed/seed-1.6-flashAPI, workspace0.079 / 0.3170.24 cr262K
Seed-2.0-Minibytedance-seed/seed-2.0-miniAPI, workspace0.105 / 0.4220.32 cr262K
Seed 1.6bytedance-seed/seed-1.6API, workspace0.264 / 2.111.3 cr262K
Seed-2.0-Litebytedance-seed/seed-2.0-liteAPI, workspace0.264 / 2.111.3 cr262K
Seed 2.1 Turbobytedance-seed/seed-2-1-turboAPI, workspace0.527 / 2.641.8 cr262K
Seed-2.0-Codebytedance-seed/seed-2.0-codeAPI, workspace0.527 / 3.172.1 cr262K
Listed but not routable (153)

Audio and embedding models, image models that are not chat models, models with no published rate, and the ids their provider is not serving. None of these can be called. Why.

  • amazon/nova-premier-v1 refused
  • anthropic/claude-opus-4 refused
  • aura-sr image
  • auto chat
  • autoclaw chat
  • baai/bge-base-en-v1.5 embedding
  • baai/bge-large-en-v1.5 embedding
  • baai/bge-m3 embedding
  • birefnet-v2 image
  • cohere/north-mini-code refused
  • crystal-upscaler image
  • deepgram-nova-3 audio
  • deepseek/deepseek-v4-pro-0813 refused
  • eleven_flash_v2_5 audio
  • eleven_v3 audio
  • elevenlabs-music-v1 audio
  • fast-sdxl image
  • flux-2-flex image
  • flux-2-pro image
  • flux-2-pro-i2i image
  • flux-2-pro-outpaint image
  • flux-3-i2v image
  • flux-kontext-max image
  • flux-kontext-pro image
  • flux-pro image
  • gemini-omni-flash-i2v image
  • gemini-omni-flash-r2v image
  • gemini-omni-flash-v2v image
  • google/gemini-3-pro-image refused
  • google/gemini-embedding-001 embedding
  • google/gemini-embedding-2 embedding
  • google/lyria-3-clip-preview chat
  • google/lyria-3-pro-preview chat
  • gpt-image-1 image
  • gpt-image-1.5 image
  • gpt-image-2 image
  • gpt-image-2.5-flare image
  • gpt-image-2.5-sunburst image
  • grok-imagine image
  • grok-imagine-edit image
  • grok-imagine-image-2 image
  • grok-imagine-image-2-edit image
  • grok-imagine-video-1.5-i2v image
  • grok-imagine-video-i2v image
  • grok-imagine-video-v2v image
  • happy-horse-1.1-i2v image
  • happy-horse-1.1-r2v image
  • ideogram-v3 image
  • ideogram-v3-remix image
  • intfloat/e5-base-v2 embedding
  • intfloat/e5-large-v2 embedding
  • intfloat/multilingual-e5-large embedding
  • kling-2.5-turbo-i2v image
  • kling-o3-pro-i2v image
  • kling-o3-pro-v2v image
  • kling-o3-standard-i2v image
  • kling-o3-standard-v2v image
  • kling-v3-image image
  • kling-v3-image-edit image
  • kling-v3-pro-i2v image
  • kling-v3-standard-i2v image
  • krea-2-turbo image
  • liquid/lfm-2.5-2.6b refused
  • liquid/lfm-2.5-embedding-350m:free embedding
  • mancer/weaver refused
  • meta/muse-spark-1.1 refused
  • meta/muse-spark-1.2 refused
  • minimax-h3-i2v image
  • minimax-h3-r2v image
  • mistralai/codestral-embed-2505 embedding
  • mistralai/mistral-embed-2312 embedding
  • nano-banana-2 image
  • nano-banana-2-edit image
  • nano-banana-pro image
  • nano-banana-pro-direct image
  • nano-banana-pro-direct-edit image
  • nvidia/llama-nemotron-embed-vl-1b-v2:free embedding
  • nvidia/nemotron-3-embed-1b:free embedding
  • nvidia/nemotron-3-nano-omni-30b-a3b-reasoning refused
  • nvidia/nemotron-3.5-content-safety refused
  • openai/gpt-5-image refused
  • openai/gpt-5-image-mini refused
  • openai/gpt-5-pro refused
  • openai/gpt-5.2-chat refused
  • openai/gpt-5.2-pro refused
  • openai/gpt-5.4-image-2 refused
  • openai/gpt-audio refused
  • openai/gpt-audio-mini refused
  • openai/o1 refused
  • openai/o1-pro refused
  • openai/o3 refused
  • openai/o3-mini refused
  • openai/o3-mini-high refused
  • openai/o3-pro refused
  • openai/o4-mini refused
  • openai/o4-mini-high refused
  • openai/text-embedding-3-large embedding
  • openai/text-embedding-3-small embedding
  • openai/text-embedding-ada-002 embedding
  • perplexity/pplx-embed-v1-0.6b embedding
  • perplexity/pplx-embed-v1-4b embedding
  • perplexity/sonar refused
  • perplexity/sonar-deep-research refused
  • perplexity/sonar-pro refused
  • perplexity/sonar-pro-search refused
  • perplexity/sonar-reasoning-pro refused
  • pika-i2v image
  • private/gemma4-31b refused
  • private/gpt-oss-120b refused
  • private/kimi-k3 refused
  • private/llama3-3-70b refused
  • qwen-image-2 image
  • qwen-image-2-edit image
  • qwen-image-3 image
  • qwen-image-3-edit image
  • qwen/qwen3-8b refused
  • qwen/qwen3-embedding-4b embedding
  • qwen/qwen3-embedding-8b embedding
  • recraft-v4.1 image
  • recraft-v4.1-svg image
  • relace/relace-apply-3 refused
  • sakana/fugu-ultra refused
  • sakana/sakana-namazu refused
  • seedance-2-5-i2v image
  • seedance-2-fast-i2v image
  • seedance-2-i2v image
  • seedream-4.5 image
  • seedream-4.5-edit image
  • seedream-v5-lite image
  • seedream-v5-lite-edit image
  • seedream-v5-pro image
  • seedream-v5-pro-edit image
  • sentence-transformers/all-minilm-l12-v2 embedding
  • sentence-transformers/all-minilm-l6-v2 embedding
  • sentence-transformers/all-mpnet-base-v2 embedding
  • sentence-transformers/multi-qa-mpnet-base-dot-v1 embedding
  • sentence-transformers/paraphrase-minilm-l6-v2 embedding
  • thedrummer/cydonia-24b-v4.1 refused
  • thenlper/gte-base embedding
  • thenlper/gte-large embedding
  • topaz-upscale image
  • veo3-fast-i2v image
  • veo3-i2v image
  • voyageai/voyage-4 embedding
  • voyageai/voyage-4-large embedding
  • voyageai/voyage-4-lite embedding
  • voyageai/voyage-code-4 embedding
  • voyageai/voyage-multimodal-3.5 embedding
  • wan-3.0-i2v image
  • wan-3.0-prime-i2v image
  • wan-3.0-prime-r2v image
  • wan-3.0-r2v image
  • xai-realtime-voice audio

Reading the table

Runs on
API means POST /v1/chat/completions accepts it. Workspace means the browser can run it. Video is workspace only.
Turn
Credits for a typical chat turn: 1,000 tokens in, 500 out. Thinking models run above this because reasoning is billed as output.
Picture
The measured credits per image where we have measured it; the reservation otherwise.
Clip
The cheapest published shape and length. Longer and larger cost more; the workspace shows the exact price before you render.

Ids that the catalog lists but the provider is not currently serving are left out. Listed but refused explains.