DeepInfra Modelos
Inferencia serverless de bajo costo para modelos abiertos con tarifas transparentes por token.

Llama 3.3 70B Turbo (DeepInfra)
0,1 US$ / 0,32 US$ por 1 millón de tokens
Llama 3.1 8B Turbo (DeepInfra)
0,02 US$ / 0,04 US$ por 1 millón de tokens
DeepSeek V4 Flash (DeepInfra)
0,09 US$ / 0,18 US$ por 1 millón de tokens
DeepSeek V4 Pro (DeepInfra)
1,30 US$ / 2,60 US$ por 1 millón de tokens
Llama 4 Scout (DeepInfra)
0,1 US$ / 0,3 US$ por 1 millón de tokens
Llama 4 Maverick (DeepInfra)
0,2 US$ / 0,8 US$ por 1 millón de tokens
Qwen3 32B (DeepInfra)
0,08 US$ / 0,28 US$ por 1 millón de tokens
Mistral Nemo (DeepInfra)
0,019 US$ / 0,03 US$ por 1 millón de tokens
Gemma 4 31B Turbo (DeepInfra)
0,09 US$ / 0,34 US$ por 1 millón de tokens
Sobre DeepInfra
Inferencia serverless de bajo costo para modelos abiertos con tarifas transparentes por token. DeepInfra aparece en CostUse como proveedor de modelos de IA con precio por token. Esta página reúne las calculadoras publicadas del catálogo para que compare tarifas de lista, proyecte volumen mensual y abra cada modelo con la fuente pública junto al número.
Hay 9 modelos publicados de DeepInfra aquí. En el mix 70/30, los precios combinados de lista van de 0,0223 US$ a 1,69 US$ por 1 millón de tokens, con mediana de 0,16 US$. La mayor ventana de contexto listada en este grupo es de 1.024.000 tokens. La comprobación de precios más reciente en este grupo es 2026-07-30.
Página de precios oficiales de DeepInfra
Tabla de precios de los modelos DeepInfra
Los valores siguientes son precios de lista por 1 millón de tokens. El mixto 70/30 es un escenario de planificación: cambie la mezcla en la calculadora de cada modelo si su tráfico es más pesado en output.
| Modelo | Input / 1M | Output / 1M | Mixto 70/30 | Contexto | Comprobado |
|---|---|---|---|---|---|
| Mistral Nemo (DeepInfra) | 0,019 US$ | 0,03 US$ | 0,0223 US$ | 128.000 | |
| Llama 3.1 8B Turbo (DeepInfra) | 0,02 US$ | 0,04 US$ | 0,026 US$ | 128.000 | |
| DeepSeek V4 Flash (DeepInfra) | 0,09 US$ | 0,18 US$ | 0,117 US$ | 1.024.000 | |
| Qwen3 32B (DeepInfra) | 0,08 US$ | 0,28 US$ | 0,14 US$ | 40.000 | |
| Llama 4 Scout (DeepInfra) | 0,1 US$ | 0,3 US$ | 0,16 US$ | 320.000 | |
| Gemma 4 31B Turbo (DeepInfra) | 0,09 US$ | 0,34 US$ | 0,165 US$ | 256.000 | |
| Llama 3.3 70B Turbo (DeepInfra) | 0,1 US$ | 0,32 US$ | 0,166 US$ | 128.000 | |
| Llama 4 Maverick (DeepInfra) | 0,2 US$ | 0,8 US$ | 0,38 US$ | 1.024.000 | |
| DeepSeek V4 Pro (DeepInfra) | 1,30 US$ | 2,60 US$ | 1,69 US$ | 1.024.000 |
Cómo leer el costo de API de DeepInfra
Input y output casi nunca cuestan lo mismo. En cargas de chat y agentes, la longitud de la respuesta suele dominar la factura. Use las bandas de volumen de cada modelo (desde pocos tokens hasta decenas de millones) para ver el punto en el que un tier “mini” o “flash” gana al flagship en costo por resultado aceptado, no solo en precio unitario.
Cuando la fuente publica caché de input, la calculadora del modelo permite activar esa tarifa. En prompts de sistema estables y RAG con documentos repetidos, la caché mueve el presupuesto mensual más que cambiar de modelo dentro de la misma familia.
Calculadoras DeepInfra en este catálogo
Las tarjetas en la parte superior de esta página abren la página completa de cada modelo: precio, calculadora interactiva, perfil de costo y preguntas frecuentes. Empiece por el escenario más cercano a su producto y solo después compare con el resto de la línea DeepInfra.
Preguntas frecuentes sobre DeepInfra
¿Cuántos modelos DeepInfra tienen calculadora en CostUse?
Hay 9 modelos publicados de DeepInfra, cada uno con tarifas de input y output (cuando la fuente las separa), bandas de volumen y enlace a la página oficial de precios.
¿Cuál es el modelo DeepInfra más barato en este catálogo?
En la mezcla 70% input / 30% output, Mistral Nemo (DeepInfra) es la opción más barata de este grupo, a 0,0223 US$ por 1 millón de tokens. Abra la calculadora del modelo para probar su propia mezcla.
¿Los precios de DeepInfra incluyen descuentos e impuestos?
No. Las calculadoras usan precios de lista públicos. Compromisos anuales, créditos promocionales, regiones, impuestos y descuentos comerciales no entran en el número mostrado: confirme siempre la fuente citada en la ficha del modelo.
¿Cómo planificar el presupuesto mensual con la API de DeepInfra?
Elija el modelo, estime tokens de input y output por request, multiplique por requests/día y por 30. Compare el flagship con tiers más baratos: muchas cargas de clasificación y enrutado caben en modelos económicos sin perder la barra de calidad.
¿Vale la pena pagar el tier más caro de DeepInfra?
DeepSeek V4 Pro (DeepInfra) cuesta cerca de 1,69 US$ por 1M de tokens en el mix 70/30, frente a 0,0223 US$ en Mistral Nemo (DeepInfra). Use el tier alto cuando la tarea exige razonamiento largo o menos reintentos; reserve el barato para alto volumen y tareas simples.