TokenMaxxing Logo
TokenMaxxing
52 live models • One key • Flat ₹99 per 1M tokens

Every model, best first.

The full live catalog behind your single key — flagship reasoning, agentic coders, vision, ultra-fast flash, embeddings and more providers. Pick a lane below; the router leans toward the healthiest model in it with automatic failover.

64 models
DeepSeek AI
deepseek-v4-pro
DeepSeek AI • frontier reasoning
Active
DeepSeek AI
deepseek-v4-pro-0813
DeepSeek AI • frontier reasoning
Active
DeepSeek AI
deepseek-v4-flash
DeepSeek AI • ultra-low latency
Active
DeepSeek AI
deepseek-v3.2
DeepSeek AI • efficient reasoning
Active
Inception Labs
mercury-2.5
Inception Labs • diffusion LLM • ultra-fast
Active
Inception Labs
mercury-2
Inception Labs • diffusion LLM • high speed
Active
Baidu ERNIE
ernie-5.1
Baidu ERNIE • knowledge reasoning
Active
Baidu ERNIE
ernie-5.0
Baidu ERNIE • flagship reasoning
Active
Alibaba Qwen
qwen3.8-max
Alibaba Qwen • frontier reasoning
Active
Alibaba Qwen
qwen3.7-max
Alibaba Qwen • frontier reasoning
Active
Alibaba Qwen
qwen-max
Alibaba Qwen • frontier reasoning
Active
Alibaba Qwen
qwen3.8-2.4t-a95b
Alibaba Qwen • frontier reasoning
Active
Alibaba Qwen
qwq-plus
Alibaba Qwen • deep reasoning
Active
Moonshot Kimi
kimi-k3
Moonshot Kimi • long-context reasoning
Active
Zhipu GLM
glm-5.2
Zhipu GLM • frontier reasoning
Active
Alibaba Qwen
qwen3.6-max-preview
Alibaba Qwen • frontier reasoning
Active
Alibaba Qwen
qwen3.7-plus
Alibaba Qwen • balanced flagship
Active
Alibaba Qwen
qwen3.6-plus
Alibaba Qwen • balanced flagship
Active
Alibaba Qwen
qwen3.5-plus
Alibaba Qwen • balanced flagship
Active
Alibaba Qwen
qwen-plus
Alibaba Qwen • balanced flagship
Active
Alibaba Qwen
qwen3.8-flash
Alibaba Qwen • ultra-low latency
Active
Alibaba Qwen
qwen3.7-flash
Alibaba Qwen • ultra-low latency
Active
Alibaba Qwen
qwen3.6-flash
Alibaba Qwen • ultra-low latency
Active
Alibaba Qwen
qwen3.5-flash
Alibaba Qwen • ultra-low latency
Active
Alibaba Qwen
qwen-flash
Alibaba Qwen • ultra-low latency
Active
Alibaba Qwen
qwen-turbo
Alibaba Qwen • high-speed turbo
Active
Alibaba Qwen
qwen3.6-27b
Alibaba Qwen • efficient 27B
Active
Alibaba Qwen
qwen3.5-27b
Alibaba Qwen • efficient 27B
Active
Alibaba Qwen
qwen3-coder-plus
Alibaba Qwen • agentic coding
Active
Moonshot Kimi
kimi-k2.7-code
Moonshot Kimi • agentic coding
Active
Alibaba Qwen
qwen-coder-plus
Alibaba Qwen • agentic coding
Active
Alibaba Qwen
qwen3-coder-next
Alibaba Qwen • agentic coding
Active
Alibaba Qwen
qwen3-coder-480b-a35b-instruct
Alibaba Qwen • MoE coding giant
Active
Alibaba Qwen
qwen3-coder-30b-a3b-instruct
Alibaba Qwen • lightweight coder
Active
Alibaba Qwen
qwen3-coder-flash
Alibaba Qwen • fast coding
Active
Alibaba Qwen
qwen3-vl-plus
Alibaba Qwen • multimodal vision
Active
Alibaba Qwen
qwen-vl-max
Alibaba Qwen • flagship vision
Active
Alibaba Qwen
qwen-vl-plus
Alibaba Qwen • multimodal vision
Active
Alibaba Qwen
qwen3-vl-flash
Alibaba Qwen • fast vision
Active
Alibaba Qwen
qwen-vl-ocr
Alibaba Qwen • document OCR
Active
Alibaba Qwen
qwen3.5-omni-plus
Alibaba Qwen • omni multimodal
Active
Alibaba Qwen
qwen3.5-omni-flash
Alibaba Qwen • fast omni
Active
Google Gemini
gemini-2.5-pro
Google • flagship multimodal
Active
Google Gemini
gemini-2.5-flash
Google • fast multimodal
Active
Google Gemini
gemini-2.0-flash
Google • fast multimodal
Active
Google Gemini
gemini-2.0-flash-lite
Google • lightest flash
Active
Meta Llama
llama-3.3-70b-versatile
Meta • via Groq, ultra-fast
Active
Meta Llama
llama-3.1-8b-instant
Meta • via Groq, instant
Active
Mistral AI
mixtral-8x7b-32768
Mistral AI • via Groq, MoE
Active
Meta Llama
llama3.1-70b
Meta • via Cerebras, wafer-speed
Active
Meta Llama
llama3.1-8b
Meta • via Cerebras, wafer-speed
Active
Stability AI • Baidu
stable-diffusion-xl
Stability AI / Baidu • photorealistic diffusion
Active
QWEN-CLOUD
text-embedding-v4
Alibaba Qwen • 1536/1024-dim dense vector
Active
QWEN-CLOUD
text-embedding-v3
Alibaba Qwen • 1024-dim dense vector
Active
Alibaba Qwen
qwen3.7-text-embedding
Alibaba Qwen • vector embeddings
Active
Baidu Qianfan
bge-large-zh
BAAI / Baidu • high-precision embeddings
Active
Baidu Qianfan
bge-large-en
BAAI / Baidu • English embeddings
Active
Baidu Qianfan
tao-8k
Baidu Qianfan • 8K-context embeddings
Active
QWEN-CLOUD
embedding-v1
Baidu Qianfan • semantic embeddings
Active
Baidu Qianfan
m3e-base
Baidu Qianfan • multi-lingual embeddings
Active
Alibaba Wan Video
wanx2.1-t2v-turbo
Alibaba Wan • text-to-video turbo
Not available at the moment
Alibaba Wan Video
wanx2.1-t2v-plus
Alibaba Wan • cinema HD video
Not available at the moment
QWEN-CLOUD
sora-1.0
OpenAI Sora • motion video
Not available at the moment
QWEN-CLOUD
cogvideox-5b
Zhipu AI • high-res video generator
Not available at the moment
Need a model that's not listed? We wire AI models on demand.
From the latest Google Gemini drops to ultra-low-latency diffusion & image models to Nvidia NIM builds — tell us the model, we plug it into your same key at the same flat ₹99/1M rate.
Gemini latest Diffusion • Flux • SDXL-Turbo Nvidia NIM Whisper • TTS • custom