AI Applications

Melhores geradores de imagem por IA: comparativo e preços (2026)

A resposta curta (julho de 2026): As seis ferramentas que os profissionais realmente usam se dividem em três categorias: apps por assinatura (Midjourney a partir de $10/mês, Adobe Firefly a partir de $9.99/mês), APIs de pagamento por uso (OpenAI gpt-image-2 a partir de $0.005/imagem, Black Forest Labs FLUX.2 a partir de $0.014/megapixel, Google Imagen 4 a cerca de $0.02/imagem via Vertex AI) e modelos de pesos abertos que você roda localmente (Stable Diffusion 3.5, FLUX.2 [dev], Ideogram 4.0). Mas leia a licença antes de auto-hospedar: só o Stable Diffusion 3.5 é gratuito para uso comercial de imediato (dentro de um limite de receita); os pesos abertos do FLUX.2 [dev] e do Ideogram 4.0 são de uso não comercial, a menos que você compre uma licença separada. O Midjourney V8.2 lidera na qualidade artística, o Ideogram 4.0 lidera na renderização de texto dentro das imagens, o Adobe Firefly lidera na segurança de propriedade intelectual para uso comercial, e o Stable Diffusion 3.5 não custa nada por imagem depois que sua GPU está paga. Escolha pelo fluxo de trabalho e pelo tipo de resultado, não apenas por rankings de benchmark.

Última verificação: 27 de julho de 2026, com base na documentação e nas páginas de preços oficiais.

Entre o que você está realmente escolhendo

Três modelos de negócio diferentes definem essa categoria, e a sua escolha do modelo de acesso importa tanto quanto a escolha da ferramenta.

Apps por assinatura (Midjourney, Firefly avulso) dão a você uma cota mensal de créditos ou de horas de GPU. Ideal para geração diária sem custo de infraestrutura.

APIs de pagamento por imagem (gpt-image-2, FLUX.2, Imagen 4) cobram por geração, sem taxa por assento. Ideal para desenvolvedores que criam produtos ou para picos ocasionais de alta qualidade.

Pesos abertos auto-hospedados (Stable Diffusion 3.5, FLUX.2 [dev], Ideogram 4.0) não custam nada por imagem depois do hardware. Ideal para fluxos de alto volume, projetos sensíveis à privacidade e equipes que precisam fazer fine-tuning com seus próprios dados. Confira a licença primeiro: o Stable Diffusion 3.5 é gratuito para uso comercial dentro de um limite de receita de $1M, mas os pesos abertos do FLUX.2 [dev] e do Ideogram 4.0 são licenciados apenas para uso não comercial, a menos que você pague por um acordo comercial.

Ferramenta Modelo de acesso Preço de entrada Modelo atual Ponto forte
Midjourney Assinatura (web) $10/mo V8.2 Qualidade artística, saída nativa em 2K
OpenAI gpt-image-2 API, pagamento por imagem $0.005/image (baixa qualidade) gpt-image-2 Aderência às instruções, edição de imagem
Adobe Firefly Assinatura ou pacote CC Grátis (25 créditos/mês) Image Model 5 Segurança de IP comercial, integração com CC
FLUX.2 (BFL) API, por megapixel $0.014/MP (klein 4B) FLUX.2 [max] Fotorrealismo, opção de pesos abertos
Ideogram 4.0 Assinatura web + API + pesos abertos Auto-hospedagem grátis (não comercial) 4.0 (9.3B params) Renderização de texto dentro das imagens
Stable Diffusion 3.5 Pesos abertos, auto-hospedagem Grátis (só o custo do hardware) SD 3.5 Large (8.1B) Custo zero por imagem, fine-tuning completo

Midjourney V8.2: melhor para qualidade artística

O Midjourney funciona por um app web em midjourney.com. O bot do Discord ainda funciona, mas a interface web é a principal em 2026. Você entra, digita um prompt, aperta Enter e recebe quatro variações. Sem precisar de comandos de barra.

O modelo padrão atual é o V8.2, padrão desde 24 de julho de 2026 (o V8.1 chegou em alfa em 14 de abril de 2026). Melhorias práticas em relação ao V7: saída nativa em 2048x2048 sem etapa de upscale separada, velocidade de geração cerca de 4-5x mais rápida que versões anteriores, e um modo Raw que remove a estética padrão do modelo quando você precisa de mais aderência ao prompt.

Planos e o que cada um realmente inclui:

Plano Preço mensal Preço anual (por mês) Horas de GPU rápida/mês Diferencial
Basic $10 $8 3.3 horas Acesso de entrada
Standard $30 $24 15 horas Relax Mode ilimitado
Pro $60 $48 30 horas Stealth Mode
Mega $120 $96 60 horas Vazão máxima

O Relax Mode é o ponto de virada. Assinantes do Basic esgotam as 3.3 horas de GPU rápida e param. Do Standard para cima é possível enfileirar imagens ilimitadas em velocidade lenta depois que as horas rápidas acabam. Para a maioria dos criadores individuais, o Standard é o mínimo prático. O Pro adiciona o Stealth Mode, que mantém seus resultados fora da galeria pública. Tempo adicional de GPU rápida custa $4/hora em qualquer plano.

Não há teste gratuito em julho de 2026. A cobrança anual economiza 20%.

O Midjourney não tem API pública para desenvolvedores. Equipes que criam produtos devem usar FLUX.2 ou gpt-image-2 no lugar.

OpenAI gpt-image-2: melhor para aderência às instruções e edição de imagem

A OpenAI removeu o DALL-E 3 da API em 12 de maio de 2026. O modelo de imagem atual é o gpt-image-2. O GPT Image 1 está previsto para ser descontinuado em 23 de outubro de 2026, então novos projetos de API devem mirar diretamente no gpt-image-2.

O gpt-image-2 aceita prompts de texto, imagens de referência, ou ambos. Sua principal vantagem sobre ferramentas apenas generativas é a edição: passe uma foto de produto e peça para trocar o fundo, adicionar um logo ou ajustar a iluminação, e ele segue instruções complexas de várias etapas com precisão. Isso o torna a escolha padrão para automação de marketing e pipelines de imagem de e-commerce.

Preço por imagem, em resoluções comuns:

Qualidade Quadrada (1024x1024) Retrato/paisagem (1024x1536)
Baixa $0.006 $0.005
Média $0.053 $0.041
Alta $0.211 $0.165

A Batch API reduz todos os preços pela metade. As orientações retrato e paisagem custam sensivelmente menos que a quadrada nas qualidades média e alta, então oriente seu pipeline de acordo se o custo importa.

O acesso é pelo endpoint da Images API ou pela Responses API para tarefas multimodais. Ambos estão disponíveis para qualquer desenvolvedor com uma chave de API da OpenAI; nenhuma assinatura do ChatGPT é necessária, embora a OpenAI exija a verificação da organização na API antes de liberar o acesso ao gpt-image-2.

Adobe Firefly Image Model 5: melhor para segurança de IP comercial

O diferencial do Firefly é a procedência dos dados de treinamento. A Adobe treinou seus modelos com conteúdo licenciado do Adobe Stock e imagens de domínio público. Para organizações com revisão jurídica formal, isso dá aos resultados do Firefly uma posição comercial mais clara do que os resultados do Midjourney ou do FLUX, treinados com dados raspados da web. O Firefly também anexa Content Credentials (metadados C2PA) a cada imagem gerada, apoiando o rastreamento de procedência em fluxos de publicação.

O modelo atual é o Firefly Image Model 5, disponível de forma geral desde março de 2026. Os modelos customizados chegaram ao beta público no mesmo mês: você envia imagens da marca, a Adobe treina uma variante ajustada, e você gera resultados consistentes com a marca sem rodar sua própria infraestrutura de ML.

Planos avulsos do Firefly:

Plano Preço mensal Créditos generativos/mês
Free $0 25
Standard $9.99 2,000
Pro $19.99 4,000
Pro Plus $49.99 10,000
Premium $199.99 50,000

O Creative Cloud Pro (o plano antes chamado de All Apps, agora $69.99/mo com cobrança anual) inclui 4,000 créditos do Firefly e acesso ao Firefly dentro do Photoshop, Illustrator e Express. O tier mais novo da Adobe, o Creative Cloud Standard, custa $54.99/mo. Se você já paga por um plano do Creative Cloud, essa cota incluída é o seu ponto de entrada mais barato, e a integração com o Generative Fill no Photoshop é perfeita.

O app web do Firefly também disponibiliza modelos de outros fornecedores, incluindo Google e Runway, o que o torna um hub multimodelo prático para equipes que já estão no ecossistema da Adobe.

FLUX.2: melhor para fotorrealismo API-first

A Black Forest Labs usa preço por megapixel: o custo escala com a resolução de saída. Uma imagem 1024x1024 tem 1 MP. Uma imagem 2048x2048 tem 4 MP, então custa mais, embora não exatamente 4x, porque a BFL cobra mais pelo primeiro megapixel e mais barato por cada megapixel adicional. Não há assinatura nem taxa por assento em bfl.ai.

A família de modelos FLUX.2, atual em 2026:

Modelo Preço Melhor para
FLUX.2 [klein] 4B a partir de $0.014/MP Rascunhos, pipelines de alto volume
FLUX.2 [klein] 9B a partir de $0.015/MP Qualidade um pouco maior que a 4B
FLUX.2 [pro] a partir de $0.03/MP Padrão com qualidade de produção
FLUX.2 [flex] a partir de $0.05/MP Fine-tuning LoRA no momento da inferência
FLUX.2 [max] a partir de $0.07/MP Qualidade máxima, mais lento
FLUX.2 [dev] Grátis para uso não comercial (pesos abertos, local) Auto-hospedagem, fine-tuning

O FLUX.1 [schnell], o modelo rápido original da geração anterior FLUX.1, é lançado sob a licença Apache 2.0 e gratuito para auto-hospedar por tempo indeterminado, inclusive para uso comercial. Operações de edição (inpainting, outpainting, substituição de objetos) são cobradas por megapixel como a geração, e não como uma taxa fixa por operação, indo de cerca de $0.014/MP nos tiers klein a $0.045/MP e acima no [pro].

Se você já está no Google Cloud, o Imagen 4 é uma alternativa comparável de pagamento por imagem: cerca de $0.02/imagem (tier Fast) a $0.04/imagem (Standard) via Vertex AI, com a Batch API cortando os preços em 50%. O preço do Imagen 4 não aparece em destaque na página principal de preços do Google Cloud; verifique as tarifas atuais no seu console do Vertex AI antes de montar um modelo de custo.

Ideogram 4.0: a única ferramenta que renderiza texto de forma confiável dentro das imagens

O Ideogram 4.0 foi lançado em 3 de junho de 2026, como um transformer de difusão de 9.3 bilhões de parâmetros liberado com pesos abertos. Leia a licença antes de construir em cima dele: os pesos vêm sob um acordo não comercial (uso pessoal, de pesquisa e de avaliação), e a auto-hospedagem comercial exige uma licença paga separada da Ideogram, com os resultados proibidos de treinar modelos concorrentes. Sua capacidade definidora é a melhor renderização de texto da categoria dentro de imagens geradas, o recurso principal do modelo. Para qualquer imagem que exija palavras legíveis (pôster, rótulo de produto, arte para redes sociais, capa de livro, sinalização), o Ideogram 4.0 é a primeira escolha clara.

O checkpoint NF4 de pesos abertos (cerca de 4.8 GB) roda confortavelmente em uma única GPU CUDA de 24 GB pela biblioteca Diffusers da Hugging Face. Uma build FP8 maior oferece fidelidade mais alta, mas precisa de uma GPU mais nova compatível com FP8 (classe Ada ou Hopper).

Um produto web hospedado também está disponível (confira ideogram.ai para as tarifas de assinatura atuais, que mudaram entre estruturas de plano). Os tiers da API 4.0 custam $0.03/imagem (Turbo), $0.06/imagem (Default) e $0.10/imagem (Quality); o modelo mais antigo 2a Turbo é ainda mais barato, a $0.025/imagem. Recursos de referência de personagem somam custo sobre a geração base.

O prompting JSON-first é novidade na 4.0. Você passa um objeto estruturado especificando elementos de primeiro plano, fundo, tipografia e restrições de layout por bounding box, em vez de uma descrição em prosa. Útil para geração programática, quando a consistência de layout ao longo de um lote importa mais do que a flexibilidade do prompt.

O Ideogram 4.0 também ficou em segundo lugar geral em avaliações de preferência de designers entre todos os geradores de imagem no lançamento, atrás apenas de modelos proprietários de fronteira.

Stable Diffusion 3.5: imagens ilimitadas pelo custo da eletricidade

A Stability AI lançou o SD 3.5 em outubro de 2024 sob uma licença comunitária que permite uso comercial gratuito para indivíduos e organizações com menos de $1M de receita anual (acima disso, aplica-se uma Enterprise License). Três variantes de modelo:

  • Large (8.1 bilhões de parâmetros): melhor qualidade, exige uma GPU com pelo menos 16 GB de VRAM para geração confiável de 1 megapixel.
  • Large Turbo: mesma arquitetura, destilada para geração em 4 passos. Mais rápida com um pequeno custo de qualidade.
  • Medium (2.5 bilhões de parâmetros): roda em placas de consumidor com 8-12 GB de VRAM.

O setup padrão em 2026 é o ComfyUI, que expõe cada etapa do pipeline como um grafo de nós. Instale o Python 3.10 ou mais recente, clone o ComfyUI do repositório dele no GitHub, baixe o checkpoint SD 3.5 Large da página da Stability AI na Hugging Face, e carregue o fluxo padrão do SD 3.5. A maioria dos fluxos da comunidade é distribuída como grafos de nós JSON para o ComfyUI.

A economia por imagem: uma GPU consumindo 300W a cerca de $0.13/kWh (média dos EUA) custa cerca de $0.04/hora para rodar. A 2 imagens por minuto, isso dá menos de $0.001 por imagem. O ponto de equilíbrio contra o FLUX.2 [pro] a $0.03/imagem é de cerca de 30-40 imagens por sessão, uma vez contado o tempo de aquecimento.

O motivo real para auto-hospedar é volume e customização. Você pode treinar adaptadores LoRA com seus próprios dados, usar nós customizados do ComfyUI, e processar milhares de imagens sem acumular custo por imagem.

Como escolher

Sua imagem precisa de texto legível embutido: Ideogram 4.0, por larga margem.

Sua organização tem um processo de revisão jurídica para procedência de imagens: Adobe Firefly Pro ou Pro Plus, com os Content Credentials ativados.

Você está montando um pipeline de API: FLUX.2 [pro] a $0.03/MP para trabalho fotorrealista; gpt-image-2 medium a $0.041/imagem (orientação retrato) para tarefas de aderência às instruções; Imagen 4 Fast a cerca de $0.02/imagem se sua infraestrutura já está no Google Cloud.

Você quer o melhor resultado artístico e prefere uma assinatura: o Midjourney Standard ($30/mo) dá a você o Relax Mode mais a qualidade do V8.2. Suba para o Pro ($60/mo) só se precisar do Stealth Mode.

Você gera altos volumes e tem uma GPU capaz: auto-hospedar o Stable Diffusion 3.5 Large ou o FLUX.2 [dev] reduz o custo por imagem para quase zero. O investimento em hardware se paga em poucos meses de uso moderado, comparado às tarifas de API hospedada.

Em 2026, a maioria das ferramentas converge para o fotorrealismo em prompts limpos. Os diferenciais de verdade são a renderização de texto (Ideogram), a certeza da licença comercial (Firefly), a economia de API por imagem (FLUX.2, gpt-image-2) e o volume com custo marginal zero (SD 3.5).

Perguntas frequentes

Posso usar imagens do Midjourney comercialmente?
Sim, nos planos pagos. Os Termos de Serviço do Midjourney concedem aos assinantes pagos uma licença comercial ampla sobre seus resultados. Confira os termos atuais em midjourney.com antes de usar os resultados em trabalhos com exposição jurídica significativa, já que os termos foram atualizados periodicamente.

O que aconteceu com o DALL-E 3?
A OpenAI removeu o DALL-E 3 da sua API em 12 de maio de 2026. O substituto atual é o gpt-image-2, que faz tanto geração quanto edição e oferece aderência às instruções bem melhor em prompts complexos. O GPT Image 1 é descontinuado em 23 de outubro de 2026; novos projetos de API devem mirar diretamente no gpt-image-2.

Existe um gerador de imagem por IA realmente utilizável e gratuito em 2026?
O tier gratuito do Adobe Firefly dá a você 25 créditos por mês, o suficiente para experimentação leve. O Stable Diffusion 3.5 Medium é gratuito para auto-hospedar, inclusive para trabalho comercial dentro de um limite de receita de $1M, se você tiver uma GPU com 8-12 GB de VRAM e algumas horas para a configuração. Os pesos abertos do Ideogram 4.0 também são gratuitos para rodar localmente, mas apenas para uso não comercial, a menos que você compre uma licença comercial.

Algum desses geradores permite conteúdo NSFW?
Midjourney, Firefly e os produtos hospedados da Ideogram proíbem, todos, conteúdo NSFW nos seus termos de serviço. Modelos auto-hospedados (SD 3.5, FLUX.2 [dev], pesos abertos do Ideogram 4.0) rodam sem os filtros de conteúdo que as APIs hospedadas aplicam, sujeitos às leis da sua jurisdição e aos termos de licença de cada modelo.

Posso fazer fine-tuning de algum deles com imagens da minha própria marca?
Sim, de vários. Stable Diffusion 3.5 e FLUX.2 [dev] suportam fine-tuning completo localmente. O FLUX.2 [flex] suporta LoRA no momento da inferência pela API hospedada. Os modelos customizados do Adobe Firefly (beta público em março de 2026) deixam você treinar com ativos da marca pela interface web, sem nenhuma infraestrutura de ML do seu lado.

O mercado de geração de imagens se atualiza mais rápido que a maioria das categorias de software. Fique por dentro lendo a AI Weekly de graça, 3 edições por semana, lida por mais de 40.000 profissionais.