HomeAI APIs › Preço-desempenho
escolha de melhor valor
misturado $/1 milhão
seu custo mensal
pontuação de valor

Modelos classificados

O preço combinado usa sua proporção de entrada/saída. Pontuação de valor = inteligência ÷ preço combinado, normalizado para que o líder seja 100. Inteligência é um índice de referência, não um benchmark oficial.

ModeloEntrada/Saída $/1 milhãoCombinado $/1 milhãoQI*ValorSeu $/mês
⚠️ O índice de inteligência (marcado como IQ*) é uma referência direcional para 2026, não uma autoridade de referência – as classificações dos modelos mudam com novos lançamentos e dependem da tarefa. Os preços são taxas pré-pagas publicadas por milhão de tokens e excluem descontos em cache, lote e volume. Sempre valide suas duas ou três escolhas principais em seu próprio conjunto de avaliação antes de se comprometer. · Informar preço desatualizado →

O preço do título esconde a decisão real

Comparar LLMs em seu preço de entrada por milhão de tokens é como a maioria das tabelas de custos funciona, e é enganosa de duas maneiras. Primeiro, os tokens de saída geralmente custam de três a cinco vezes mais que os de entrada, portanto, um modelo que parece barato na entrada pode ser caro para uma carga de trabalho que escreve respostas longas. Em segundo lugar, o preço não diz nada sobre capacidade – o objetivo do modelo. Uma ferramenta que custa um décimo mais, mas falha em um terço de suas tarefas, não é barata; é caro quando você conta as novas tentativas e a limpeza humana. A relação preço-desempenho reúne ambos os problemas em um número: uma pontuação de capacidade dividida pelo misturado preço do seu mix real de tokens, para que você compare o valor, não apenas o custo.

Essa reformulação muda as decisões. Para trabalhos tolerantes e de alto volume – classificação, etiquetagem, extração do primeiro rascunho – a escolha de melhor valor geralmente é um modelo pequeno ou aberto que é quase tão bom quanto o de fronteira por uma fração do preço. Para trabalhos em que um erro é dispendioso – código de produção, elaboração legal ou médica, ações de agentes – a matemática do valor favorece, com razão, um modelo mais forte, porque a sua pontuação mais elevada supera o prémio. O padrão inteligente que a maioria das equipes adota é rota solicitações fáceis ao líder de valor e reserva um modelo de fronteira para as difíceis. Depois de escolher, dimensione a nota real no Calculadora de custo de token LLM e corte ainda mais com cache de prompt.

Como usar

1. Insira os tokens típicos de entrada e saída para uma solicitação — isso define seu mix de custos real.
2. Opcionalmente, adicione solicitações mensais para ver o custo em dólares de cada modelo para sua carga de trabalho.
3. Escolha se deseja classificar por valor, preço bruto ou inteligência e leia a tabela. O líder em valor é o modelo que oferece a maior capacidade por dólar para seu forma de token.

Erros comuns

A julgar apenas pelo preço dos insumos. O trabalho com produção pesada é avaliado pela taxa de produção – defina sua proporção real. Perseguindo o mais barato. Se falhar em sua tarefa, o retrabalho custará mais do que os tokens economizados. Pagar demais por um modelo de fronteira em todos os lugares. A maioria das solicitações não precisa disso; reserve para a fatia dura. Confiando em uma pontuação. O índice de inteligência é um ponto de partida – a única referência que conta é a sua própria avaliação definida de acordo com suas próprias instruções.

Estimativa apenas. O índice de inteligência é uma referência direcional; valide suas próprias tarefas antes de escolher.

Compartilhar: 𝕏 Postar Reddit
Hospede seu projeto:DigitalOcean – $ 200 grátis ↗VPS da Hostinger
Ajuste fino versus solicitaçãoPrevisão de custos de APICalculadora de custos de ajuste finoCalculadora de custos de incorporaçõesAPI LLM mais barata