Llama 3.3 70B (Hyperbolic)
$0.12 in · $0.3 out per 1M tokens
Start with a provider or open a model directly. Each page combines its published rates with workload controls, budget tables, and the original pricing source.
Open-model inference API plus GPU marketplace with aggressive per-token rates.
$0.12 in · $0.3 out per 1M tokens
$0.1 in · $0.1 out per 1M tokens
$0.25 in · $0.25 out per 1M tokens
SambaNova Cloud inference with high-throughput open models and public per-token rates.
$0.22 in · $0.59 out per 1M tokens
$0.22 in · $0.59 out per 1M tokens
$0.6 in · $1.20 out per 1M tokens
$0.6 in · $2.40 out per 1M tokens
Alibaba Cloud Model Studio first-party Qwen models with international token rates.
$2.50 in · $7.50 out per 1M tokens
$0.4 in · $2.40 out per 1M tokens
$0.1 in · $0.4 out per 1M tokens
Fast open-model Model APIs with cache-aware per-token pricing.
$1.40 in · $4.40 out per 1M tokens
$0.5 in · $1.50 out per 1M tokens
$0.14 in · $0.4 out per 1M tokens
$0.3 in · $1.20 out per 1M tokens
Unified multi-provider model router with public per-token list rates.
$0.75 in · $4.50 out per 1M tokens
$3.00 in · $15.00 out per 1M tokens
$1.50 in · $7.50 out per 1M tokens
$0.15 in · $0.6 out per 1M tokens
$0.269 in · $0.4 out per 1M tokens
$0.1 in · $0.3 out per 1M tokens
Azure OpenAI Service Global Standard pay-as-you-go token rates for enterprise GPT models.
$0.75 in · $4.50 out per 1M tokens
$0.15 in · $0.6 out per 1M tokens
$2.50 in · $10.00 out per 1M tokens
$2.50 in · $15.00 out per 1M tokens
Model APIs and dedicated GPU inference with public per-token list rates.
$3.00 in · $15.00 out per 1M tokens
$1.40 in · $4.40 out per 1M tokens
$2.10 in · $6.60 out per 1M tokens
$0.1 in · $0.5 out per 1M tokens
$1.74 in · $3.48 out per 1M tokens
$0.95 in · $4.00 out per 1M tokens
IBM watsonx.ai foundation models with public pay-as-you-go per-million token rates.
$0.0636 in · $0.265 out per 1M tokens
$0.371 in · $1.484 out per 1M tokens
$0.7526 in · $0.7526 out per 1M tokens
$0.106 in · $0.318 out per 1M tokens
$0.636 in · $1.908 out per 1M tokens
$0.159 in · $0.636 out per 1M tokens
Serverless open-model inference with public per-token rates for DeepSeek, Qwen, GLM, and more.
$0.13 in · $0.28 out per 1M tokens
$0.27 in · $0.42 out per 1M tokens
$0.1 in · $0.15 out per 1M tokens
$1.302 in · $4.092 out per 1M tokens
$3.00 in · $15.00 out per 1M tokens
$0.05 in · $0.45 out per 1M tokens
$0.3 in · $1.20 out per 1M tokens
Serverless open-model inference with public per-token rates and cache discounts.
$0.14 in · $0.28 out per 1M tokens
$1.40 in · $4.40 out per 1M tokens
$1.74 in · $3.48 out per 1M tokens
$0.3 in · $1.20 out per 1M tokens
$0.09 in · $0.3 out per 1M tokens
$0.1 in · $0.75 out per 1M tokens
$0.15 in · $0.4 out per 1M tokens
$0.75 in · $3.50 out per 1M tokens