DeepSeek V4 Pro (Together)
$1.74 in · $3.48 out per 1M tokens
Start with a provider or open a model directly. Each page combines its published rates with workload controls, budget tables, and the original pricing source.
Open-model serverless inference, image, audio, and dedicated GPU endpoints.
$1.74 in · $3.48 out per 1M tokens
$0.3 in · $1.20 out per 1M tokens
$3.00 in · $15.00 out per 1M tokens
$1.40 in · $4.40 out per 1M tokens
$1.04 in · $1.04 out per 1M tokens
$0.15 in · $0.6 out per 1M tokens
$0.05 in · $0.2 out per 1M tokens
$0.06 in · $0.12 out per 1M tokens
$1.20 in · $4.50 out per 1M tokens
$0.17 in · $0.25 out per 1M tokens
Search-grounded Sonar models and agent tools with token plus request fees.
$1.00 in · $1.00 out per 1M tokens
$3.00 in · $15.00 out per 1M tokens
$2.00 in · $8.00 out per 1M tokens
$2.00 in · $8.00 out per 1M tokens
Wafer-scale inference with extreme tokens-per-second on open models.
$0.35 in · $0.75 out per 1M tokens
$0.99 in · $1.49 out per 1M tokens
$2.25 in · $2.75 out per 1M tokens
Jamba hybrid models for long-context enterprise chat and document work.
$2.00 in · $8.00 out per 1M tokens
$0.2 in · $0.4 out per 1M tokens
Specialized embedding and rerank models priced per million tokens.
$0.12 in · $0 out per 1M tokens
$0.06 in · $0 out per 1M tokens
$0.02 in · $0 out per 1M tokens
$0.18 in · $0 out per 1M tokens
$0.05 in · $0 out per 1M tokens
Low-cost serverless inference for open models with transparent per-token rates.
$0.1 in · $0.32 out per 1M tokens
$0.02 in · $0.04 out per 1M tokens
$0.09 in · $0.18 out per 1M tokens
$1.30 in · $2.60 out per 1M tokens
$0.1 in · $0.3 out per 1M tokens
$0.2 in · $0.8 out per 1M tokens
$0.08 in · $0.28 out per 1M tokens
$0.019 in · $0.03 out per 1M tokens
$0.09 in · $0.34 out per 1M tokens
Kimi models with million-token context and first-party cache-aware pricing.
GLM flagship models from Z.AI with first-party cache-aware token pricing.
$1.00 in · $3.20 out per 1M tokens
$1.20 in · $4.00 out per 1M tokens
$1.40 in · $4.40 out per 1M tokens
Open-model serverless API with competitive per-token rates across Llama, Qwen, and DeepSeek.
$0.02 in · $0.05 out per 1M tokens
$0.135 in · $0.4 out per 1M tokens
$0.18 in · $0.59 out per 1M tokens
$0.27 in · $0.85 out per 1M tokens
$0.269 in · $0.4 out per 1M tokens
European AI cloud Token Factory with transparent per-token open-model inference.
$0.1 in · $0.3 out per 1M tokens
$1.40 in · $4.40 out per 1M tokens
$3.00 in · $15.00 out per 1M tokens
$1.00 in · $3.00 out per 1M tokens