Como funciona esta calculadora
O Calculadora de custos da API Vision estima quanto você pagará para enviar imagens para um modelo de visão estilo GPT-4o. Você insere uma imagem largura e altura em pixels, e a ferramenta converte essas dimensões no número de tokens de entrada o modelo cobra, já que os modelos de visão agrupam e avaliam as imagens por resolução e não por tamanho de arquivo. Multiplique essa contagem de tokens pelo seu $ por 1 milhão de tokens de entrada taxa para obter um custo por imagem e, em seguida, pelo seu imagens por mês para projetar uma fatura mensal. Os dois maiores impulsionadores são a resolução da imagem, que define tokens por imagem, e o volume mensal, que dimensiona o total.
A principal compensação a observar é resolução versus custo: imagens maiores consomem mais tokens, portanto, um pequeno aumento de dimensão pode aumentar significativamente sua conta em grande escala. Antes de enviar, reduzir a escala imagens no menor tamanho que sua tarefa ainda lê com precisão e estime cargas de trabalho de alto volume aqui primeiro para que uma surpresa de preço não apareça em sua fatura.
Perguntas frequentes
Como o custo da imagem é calculado para modelos de visão?
Os modelos de visão dividem uma imagem em blocos de 512 pixels. O preço no estilo GPT-4o cobra uma base fixa (cerca de 85 tokens) mais cerca de 170 tokens por bloco e, em seguida, cobra-os como tokens de entrada normais. Uma imagem de 1024×1024 tem quatro blocos, ou seja, cerca de 765 tokens – quanto mais megapixels, mais blocos e tokens.
Como posso reduzir o custo da API de visão?
Reduza as imagens antes de enviá-las – a resolução aumenta a contagem de blocos e a maioria das tarefas não precisa de resolução total. Use o modo de poucos detalhes quando o modelo oferecer (um custo de token fixo e barato), corte na região que importa e evite reenviar a mesma imagem nos turnos de uma conversa.