Published 2026-08-19 · reference numbers, verify before budgeting
Generate 10,000 product thumbnails on Flux Schnell and the bill is $9. Generate the same 10,000 images on GPT-image-1 at high quality and it's $1,200. Same count, same output format, 133x apart. Text-model pricing gets called out for wide spreads — the nano-model tier alone runs 29x — but image generation makes that look tame.
Extraído das taxas por imagem que rastreamos para a calculadora de custo de imagem: cada modelo que um desenvolvedor pode realmente chamar de uma API hoje (excluindo Midjourney – apenas assinatura, sem API pública), ao preço de 10.000 renderizações por mês.
| Modelo | $/imagem | Mensalmente (10.000 imagens) |
|---|---|---|
| Flux Schnell (hosted) | $0.0009 | $9.00 |
| Núcleo SDXL/SD3.5 | $0.010 | $100.00 |
| Flux Dev (hospedado) | $0.025 | $250.00 |
| Difusão Estável 3,5 Grande | $0.040 | $400.00 |
| DALL·E 3 (standard 1024) | $0.040 | $400.00 |
| Google Imagen 3 | $0.040 | $400.00 |
| Ideogram 3 | $0.050 | $500.00 |
| GPT-image-1 (médio) | $0.050 | $500.00 |
| Fluxo 1.1 Pró | $0.060 | $600.00 |
| DALL·E 3 (HD 1024) | $0.080 | $800.00 |
| GPT-image-1 (alta) | $0.120 | $1,200.00 |
| Preço de referência, julho de 2026. Exemplo resolvido: 10.000 imagens/mês. Defina o preço do seu próprio volume no calculadora de custos de geração de imagens. | ||
O Flux Schnell está em uma classe à parte – mais de 11x mais barato que o próximo modelo da lista, SDXL/SD3.5 Core, e 44x mais barato que o padrão DALL·E 3. O cluster intermediário (SD3.5 Large, padrão DALL·E 3, Imagem 3) chega a exatamente US$ 0,04, apesar de vir de três empresas não relacionadas, o que diz mais sobre a psicologia de precificação de números redondos do que sobre o custo de computação. Somente a imagem GPT-1 abrange uma faixa de 2,4x dependendo do sinalizador de qualidade – médio a alto é o maior salto dentro do modelo na mesa, maior do que a lacuna entre alguns provedores totalmente diferentes.
O preço dos tokens nos modelos de texto é definido em relação a uma unidade compartilhada – dólares por milhão de tokens – de modo que mesmo um spread de 29x permanece dentro de uma escala comparável. O preço da imagem não tem unidade compartilhada. Um modelo de peso aberto hospedado como o Flux Schnell é cobrado perto de segundos brutos de GPU, porque quem o executa (Replicate, Fal, Together) está competindo puramente na margem de infraestrutura. Um modelo fechado de fronteira como GPT-image-1 ou DALL·E 3 é avaliado em relação à qualidade de saída percebida do modelo e à escada do carro-chefe ao orçamento do próprio fornecedor, a mesma dinâmica que coloca Claude Haiku bem acima da Nova Micro no texto. Combine “preço próximo ao custo de computação marginal” com “preço próximo ao valor percebido” e você obterá uma lacuna de 133x em vez de 29x – não há limite mínimo que una as duas filosofias de preços.
O nível de qualidade torna tudo pior. O DALL·E 3 HD custa exatamente 2x o padrão DALL·E 3. GPT-image-1 custa 2,4x GPT-image-1 médio. Nenhum dos saltos é realmente sobre computação extra proporcional a esse multiplicador - é o provedor que escolhe onde traçar a linha entre "bom o suficiente para a maioria dos usuários" e "o nível pelo qual os usuários avançados pagarão mais", que é uma decisão de negócios disfarçada como um nível de preços.
Para geração de rascunhos, miniaturas, testes de variantes A/B ou qualquer coisa em que um humano não esteja examinando cada pixel, comece com Flux Schnell ou SDXL – de US$ 9 a US$ 100 por 10.000 imagens, o custo da API está próximo de um erro de arredondamento próximo a quase qualquer outro item de linha no produto. Reserve DALL·E 3 HD ou GPT-image-1 high para imagens heroicas, ativos de marketing e qualquer coisa voltada ao cliente onde a fidelidade extra vale visivelmente de 20 a 130x o preço. Executar as duas camadas lado a lado – modelo rápido para volume, modelo premium para alguns que realmente são enviados – é melhor do que escolher um modelo para todo o pipeline quase sempre. Depois de algumas centenas de milhares de imagens por mês, a auto-hospedagem de um modelo aberto em tempo de GPU alugado pode superar até mesmo a taxa de API por imagem do Flux Schnell; confira o crossover no calculadora auto-hospedada vs API. Avalie seu próprio mix de volume e qualidade no calculadora de custos de geração de imagens, e se as imagens estiverem em uma linha em uma fatura de produto maior, totalize a pilha inteira na Estimador de custos de aplicativos de IA.
Methodology: prices from our tracked image-generation rate table as of July 2026, matching each provider's published per-image or per-generation rate at the resolution/quality tier noted. Open-model rates (Flux, SDXL) reflect typical hosted per-image equivalents on GPU-time-billed platforms, not a fixed provider price — confirm current rates before budgeting a production workload.