DeepInfra Modelos
Inferência serverless de baixo custo para modelos abertos com taxas transparentes por token.

Llama 3.3 70B Turbo (DeepInfra)
US$ 0,1 / US$ 0,32 por 1 milhão de tokens
Llama 3.1 8B Turbo (DeepInfra)
US$ 0,02 / US$ 0,04 por 1 milhão de tokens
DeepSeek V4 Flash (DeepInfra)
US$ 0,09 / US$ 0,18 por 1 milhão de tokens
DeepSeek V4 Pro (DeepInfra)
US$ 1,30 / US$ 2,60 por 1 milhão de tokens
Llama 4 Scout (DeepInfra)
US$ 0,1 / US$ 0,3 por 1 milhão de tokens
Llama 4 Maverick (DeepInfra)
US$ 0,2 / US$ 0,8 por 1 milhão de tokens
Qwen3 32B (DeepInfra)
US$ 0,08 / US$ 0,28 por 1 milhão de tokens
Mistral Nemo (DeepInfra)
US$ 0,019 / US$ 0,03 por 1 milhão de tokens
Gemma 4 31B Turbo (DeepInfra)
US$ 0,09 / US$ 0,34 por 1 milhão de tokens
Sobre a DeepInfra
Inferência serverless de baixo custo para modelos abertos com taxas transparentes por token. A DeepInfra entra no CostUse como fornecedora de modelos de IA com preço por token. Esta página reúne as calculadoras publicadas do catálogo para que você compare taxas de lista, projete volume mensal e abra cada modelo com a fonte pública ao lado do número.
Há 9 modelos publicados de DeepInfra aqui. No mix 70/30, os preços combinados de lista vão de US$ 0,0223 a US$ 1,69 por 1 milhão de tokens, com mediana de US$ 0,16. A maior janela de contexto listada neste grupo é de 1.024.000 tokens. A conferência de preços mais recente neste grupo é 2026-07-30.
Página de preços oficiais da DeepInfra
Tabela de preços dos modelos DeepInfra
Os valores abaixo são preços de lista por 1 milhão de tokens. O misto 70/30 é um cenário de planejamento — troque o mix na calculadora de cada modelo se o seu tráfego for mais pesado em output.
| Modelo | Input / 1M | Output / 1M | Misto 70/30 | Contexto | Conferido |
|---|---|---|---|---|---|
| Mistral Nemo (DeepInfra) | US$ 0,019 | US$ 0,03 | US$ 0,0223 | 128.000 | |
| Llama 3.1 8B Turbo (DeepInfra) | US$ 0,02 | US$ 0,04 | US$ 0,026 | 128.000 | |
| DeepSeek V4 Flash (DeepInfra) | US$ 0,09 | US$ 0,18 | US$ 0,117 | 1.024.000 | |
| Qwen3 32B (DeepInfra) | US$ 0,08 | US$ 0,28 | US$ 0,14 | 40.000 | |
| Llama 4 Scout (DeepInfra) | US$ 0,1 | US$ 0,3 | US$ 0,16 | 320.000 | |
| Gemma 4 31B Turbo (DeepInfra) | US$ 0,09 | US$ 0,34 | US$ 0,165 | 256.000 | |
| Llama 3.3 70B Turbo (DeepInfra) | US$ 0,1 | US$ 0,32 | US$ 0,166 | 128.000 | |
| Llama 4 Maverick (DeepInfra) | US$ 0,2 | US$ 0,8 | US$ 0,38 | 1.024.000 | |
| DeepSeek V4 Pro (DeepInfra) | US$ 1,30 | US$ 2,60 | US$ 1,69 | 1.024.000 |
Como ler o custo de API da DeepInfra
Input e output quase nunca custam o mesmo. Em cargas de chat e agentes, o comprimento da resposta costuma dominar a fatura. Use as faixas de volume de cada modelo (de poucos tokens a dezenas de milhões) para ver o ponto em que um tier “mini” ou “flash” vence o flagship no custo por resultado aceito — não só no preço unitário.
Quando a fonte publica cache de input, a calculadora do modelo permite ligar essa tarifa. Em prompts de sistema estáveis e RAG com documentos repetidos, o cache muda o orçamento mensal mais do que trocar de modelo dentro da mesma família.
Calculadoras DeepInfra neste catálogo
Os cartões no topo desta página abrem a página completa de cada modelo: preço, calculadora interativa, perfil de custo e perguntas frequentes. Comece pelo cenário mais próximo do seu produto e só depois compare com o restante da linha DeepInfra.
Perguntas frequentes sobre DeepInfra
Quantos modelos DeepInfra estão com calculadora no CostUse?
Há 9 modelos publicados de DeepInfra, cada um com taxas de input e output (quando a fonte as separa), faixas de volume e link para a página de preços oficiais.
Qual o modelo DeepInfra com menor custo de lista neste catálogo?
No mix 70% input / 30% output, Mistral Nemo (DeepInfra) aparece como a opção mais barata deste grupo, a US$ 0,0223 por 1 milhão de tokens. Abra a calculadora do modelo para testar o seu próprio mix.
Os preços de DeepInfra incluem descontos e impostos?
Não. As calculadoras usam preços de lista públicos. Compromissos anuais, créditos promocionais, regiões, impostos e descontos comerciais não entram no número mostrado — confira sempre a fonte citada no cartão do modelo.
Como planejar o orçamento mensal com a API de DeepInfra?
Escolha o modelo, estime tokens de input e output por request, multiplique por requests/dia e por 30. Compare o flagship com tiers menores: muitas cargas de classificação e roteamento cabem em modelos mais baratos sem perder a barra de qualidade.
Vale a pena pagar o tier mais caro de DeepInfra?
DeepSeek V4 Pro (DeepInfra) custa cerca de US$ 1,69 por 1M de tokens no mix 70/30, frente a US$ 0,0223 em Mistral Nemo (DeepInfra). Use o tier alto quando a tarefa exige raciocínio longo ou menos retries; reserve o barato para volume alto e tarefas simples.