Llama 3.3 70B (Hyperbolic)
US$ 0,12 in · US$ 0,3 out por 1 milhão de tokens
Comece por um provedor ou abra um modelo diretamente. Cada página reúne os preços publicados, controles de carga, tabelas de orçamento e a fonte original.
API de inferência open-model e marketplace de GPU com taxas agressivas por token.
US$ 0,12 in · US$ 0,3 out por 1 milhão de tokens
US$ 0,1 in · US$ 0,1 out por 1 milhão de tokens
US$ 0,25 in · US$ 0,25 out por 1 milhão de tokens
Inferência SambaNova Cloud com modelos abertos de alto throughput e taxas públicas por token.
US$ 0,22 in · US$ 0,59 out por 1 milhão de tokens
US$ 0,22 in · US$ 0,59 out por 1 milhão de tokens
US$ 0,6 in · US$ 1,20 out por 1 milhão de tokens
US$ 0,6 in · US$ 2,40 out por 1 milhão de tokens
Modelos Qwen first-party no Alibaba Cloud Model Studio com taxas internacionais por token.
US$ 2,50 in · US$ 7,50 out por 1 milhão de tokens
US$ 0,4 in · US$ 2,40 out por 1 milhão de tokens
US$ 0,1 in · US$ 0,4 out por 1 milhão de tokens
Model APIs rápidas de modelos abertos com preço por token e cache.
US$ 1,40 in · US$ 4,40 out por 1 milhão de tokens
US$ 0,5 in · US$ 1,50 out por 1 milhão de tokens
US$ 0,14 in · US$ 0,4 out por 1 milhão de tokens
US$ 0,3 in · US$ 1,20 out por 1 milhão de tokens
Roteador unificado multi-provider com taxas públicas por token.
US$ 0,75 in · US$ 4,50 out por 1 milhão de tokens
US$ 3,00 in · US$ 15,00 out por 1 milhão de tokens
US$ 1,50 in · US$ 7,50 out por 1 milhão de tokens
US$ 0,15 in · US$ 0,6 out por 1 milhão de tokens
US$ 0,269 in · US$ 0,4 out por 1 milhão de tokens
US$ 0,1 in · US$ 0,3 out por 1 milhão de tokens
Taxas pay-as-you-go Global Standard do Azure OpenAI Service para modelos GPT empresariais.
US$ 0,75 in · US$ 4,50 out por 1 milhão de tokens
US$ 0,15 in · US$ 0,6 out por 1 milhão de tokens
US$ 2,50 in · US$ 10,00 out por 1 milhão de tokens
US$ 2,50 in · US$ 15,00 out por 1 milhão de tokens
Model APIs e inferência GPU dedicada com taxas públicas por token.
US$ 3,00 in · US$ 15,00 out por 1 milhão de tokens
US$ 1,40 in · US$ 4,40 out por 1 milhão de tokens
US$ 2,10 in · US$ 6,60 out por 1 milhão de tokens
US$ 0,1 in · US$ 0,5 out por 1 milhão de tokens
US$ 1,74 in · US$ 3,48 out por 1 milhão de tokens
US$ 0,95 in · US$ 4,00 out por 1 milhão de tokens
Modelos foundation IBM watsonx.ai com taxas públicas pay-as-you-go por milhão de tokens.
US$ 0,0636 in · US$ 0,265 out por 1 milhão de tokens
US$ 0,371 in · US$ 1,484 out por 1 milhão de tokens
US$ 0,7526 in · US$ 0,7526 out por 1 milhão de tokens
US$ 0,106 in · US$ 0,318 out por 1 milhão de tokens
US$ 0,636 in · US$ 1,908 out por 1 milhão de tokens
US$ 0,159 in · US$ 0,636 out por 1 milhão de tokens
Inferência serverless de modelos abertos com taxas públicas por token para DeepSeek, Qwen, GLM e mais.
US$ 0,13 in · US$ 0,28 out por 1 milhão de tokens
US$ 0,27 in · US$ 0,42 out por 1 milhão de tokens
US$ 0,1 in · US$ 0,15 out por 1 milhão de tokens
US$ 1,302 in · US$ 4,092 out por 1 milhão de tokens
US$ 3,00 in · US$ 15,00 out por 1 milhão de tokens
US$ 0,05 in · US$ 0,45 out por 1 milhão de tokens
US$ 0,3 in · US$ 1,20 out por 1 milhão de tokens
Inferência serverless de modelos abertos com taxas públicas por token e descontos de cache.
US$ 0,14 in · US$ 0,28 out por 1 milhão de tokens
US$ 1,40 in · US$ 4,40 out por 1 milhão de tokens
US$ 1,74 in · US$ 3,48 out por 1 milhão de tokens
US$ 0,3 in · US$ 1,20 out por 1 milhão de tokens
US$ 0,09 in · US$ 0,3 out por 1 milhão de tokens
US$ 0,1 in · US$ 0,75 out por 1 milhão de tokens
US$ 0,15 in · US$ 0,4 out por 1 milhão de tokens
US$ 0,75 in · US$ 3,50 out por 1 milhão de tokens