Now live — IQx ultra fast UltraFast catalog (7 models) + IQx Token Factory flagships · all with 20% standard markup, 1,800 TPS max, 10M context max7 IQx ultra fast + 26 Token Factory models, all liveExplore →
All 33 models. One API.
IQx ultra fast UltraFast (7) on LPU silicon, plus the full IQx Token Factory catalog (26) on H100 — reasoning, vision, embeddings, and open-weight chat — all through a single OpenAI-compatible interface.
33
Models in catalog
1,800
Max TPS
262K
Max context
/ Compare
Flagship models, side by side.
The numbers that matter: TPS, context, and price. Find the right model for your workload.
Model
Type
Platform
Context
Max TPS
Input / M
Output / M
GPT OSS 20B 128k
UltraFast · MoE
IQx ultra fast · OpenAI
128K
1,800
$0.09
$0.36
GPT OSS Safeguard 20B
UltraFast · MoE
IQx ultra fast · OpenAI
128K
1,800
$0.09
$0.36
GPT OSS 120B 128k
UltraFast · MoE
IQx ultra fast · OpenAI
128K
1,000
$0.18
$0.72
Llama 4 Scout (17Bx16E) 128k
UltraFast · MoE
IQx ultra fast · Meta
128K
1,200
$0.13
$0.41
Qwen3 32B 131k
UltraFast
IQx ultra fast · Alibaba
131K
1,300
$0.35
$0.71
Llama 3.3 70B Versatile 128k
UltraFast
IQx ultra fast · Meta
128K
1,100
$0.71
$0.95
Llama 3.1 8B Instant 128k
UltraFast
IQx ultra fast · Meta
128K
1,800
$0.06
$0.10
Nemotron-3-Ultra-550B-a55b
Reasoning · MoE 550B (55B active)
NVIDIA · Token Factory
128K
59
$1.20
$3.60
Cosmos3-Super-Reasoner
Reasoning · Vision
NVIDIA · Token Factory
128K
30
$0.12
$0.36
openbmb/MiniCPM-V-4.5
Reasoning · Vision
OpenBMB · Token Factory
32K
49.5
$0.07
$0.13
Kimi-K2.6
Reasoning · multimodal agentic
Moonshot AI · Token Factory
256K
60
$1.14
$4.80
DeepSeek-V4-Pro
Reasoning · long-horizon agent
DeepSeek · Token Factory
128K
24
$2.10
$4.20
GLM-5.1
Reasoning · multimodal
Z.ai · Token Factory
200K
25
$1.68
$5.28
Qwen3.5-397B-A17B
Reasoning · MoE 397B (17B active)
Alibaba · Token Factory
262K
80
$0.72
$4.32
GLM-5
Reasoning · multimodal
Z.ai · Token Factory
200K
47
$1.20
$3.84
Hermes-4-405B
Reasoning · verified-CoT
NousResearch · Token Factory
128K
20
$1.20
$3.60
Hermes-4-70B
Reasoning
NousResearch · Token Factory
128K
20
$0.16
$0.48
INTELLECT-3
Reasoning · MoE 100B+ RL-tuned
Prime Intellect · Token Factory
128K
35
$0.24
$1.20
Qwen3-Next-80B-A3B-Thinking
Reasoning · thinking-tuned MoE
Alibaba · Token Factory
262K
85
$0.18
$1.44
Llama-3.1-Nemotron-Ultra-253B-v1
Reasoning · enterprise
NVIDIA · Token Factory
128K
25
$0.72
$2.16
Nemotron-3-Nano-Omni
Open · error-modal reasoning
NVIDIA · Token Factory
256K
90
$0.07
$0.29
MiniMax-M2.5
Open · agentic coding
MiniMax · Token Factory
192K
36.8
$0.36
$1.44
Nemotron-3-Super-120b-a12b
Open · MoE 120B (12B active)
NVIDIA · Token Factory
128K
127
$0.36
$1.08
DeepSeek-V3.2
Open · efficient reasoning
DeepSeek · Token Factory
128K
71
$0.36
$0.54
gpt-oss-120b
Open · agentic MoE
OpenAI · Token Factory
128K
40
$0.18
$0.72
Qwen3-235B-A22B-Instruct-2507
Open · MoE 235B (22B active)
Alibaba · Token Factory
262K
27
$0.24
$0.72
Qwen3-30B-A3B-Instruct-2507
Open · MoE 30B (3B active)
Alibaba · Token Factory
32K
70
$0.12
$0.36
Qwen3-32B
Open · general 32B
Alibaba · Token Factory
32K
23
$0.12
$0.36
Gemma-3-27b-it
Open · mid-size instruct
Google · Token Factory
32K
20
$0.12
$0.36
Nemotron-3-Nano-30B-A3B
Open · MoE 30B (3B active)
NVIDIA · Token Factory
256K
60
$0.07
$0.29
Llama-3.3-70B-Instruct
Open · 70B instruct
Meta · Token Factory
128K
25
$0.16
$0.48
Qwen2.5-VL-72B-Instruct
Vision · 72B multimodal
Alibaba · Token Factory
128K
20
$0.30
$0.90
Qwen3-Embedding-8B
Embeddings · 4096-dim
Alibaba · Token Factory
32K
—
$0.01
—
Pick a plan. Start in 30 seconds.
One API key across all 33 models. From $3 one-time, $25/mo with a 5-hour window. 2 months free on annual.