Gerador de imagem IA FLUX.2 (2026): versões, preços e limites

Veja como o FLUX.2 funciona como gerador de imagem IA: compare as cinco variantes, preços por megapixel, licenças e limites no trabalho de design.

Friday, September 4, 2026Omid Saffari
Gerador de imagem IA FLUX.2 (2026): versões, preços e limites

FLUX.2 é o gerador de imagem IA para quando o resultado precisa obedecer ao projeto, não surpreender: cores de marca travadas por código hexadecimal, o mesmo personagem ao longo de dez quadros, textos que em boa parte sobrevivem e pesos que rodam na sua própria GPU. Ele não entrega a atmosfera de Midjourney. Entrega uma ferramenta para trabalho pesado.

O veredito sobre este gerador de imagem IA: controle acima do efeito surpresa

Para produzir imagens de marca com consistência e em escala, FLUX.2 é hoje a opção de pesos abertos mais forte em circulação. A Black Forest Labs, equipe de Freiburg por trás do Stable Diffusion, lançou a família em 25 de novembro de 2025 e acrescentou os modelos compactos [klein] em 15 de janeiro de 2026. O que faz dele uma ferramenta de design, e não um brinquedo, é o nível de controle: dá para fixar as cores exatas da marca por códigos hexadecimais, manter um personagem ou produto consistente entre várias gerações fornecendo até dez imagens de referência e ajustar o modelo ao seu próprio estilo visual com treinamento LoRA. Uma LoRA é um pequeno arquivo adicional que ensina uma estética específica ao modelo-base sem exigir um novo treinamento completo.

Mas não espere um oráculo estético. Midjourney ainda cria, de saída, uma imagem mais acabada e com mais intenção de design, enquanto o Nano Banana, do Google, edita fotos com maior limpeza. FLUX.2 troca essa mágica do “me surpreenda” por previsibilidade. Para designers, quase sempre é uma boa troca: uma imagem um pouco mais simples, mas reproduzível com precisão, vale mais do que outra deslumbrante que nunca sai igual de novo.

Atalho para escolher: rode o [klein] 4B se quiser gerar comercialmente no próprio hardware sem pagar pelo modelo; use [pro] na produção hospedada; escolha [flex] quando a imagem for dominada por texto; e reserve [max] para peças hero nas quais a qualidade vale mais que o custo.

Playground do FLUX.2, da Black Forest Labs
O Playground do FLUX.2 permite testar cada variante antes de integrar a API

O que é o FLUX.2, na prática

A verdadeira evolução do FLUX.2 está na troca de cérebro. Enquanto a maioria dos modelos de imagem usa um codificador de texto pequeno e pouco sofisticado para interpretar o prompt, o FLUX.2 faz essa leitura com o Mistral Small 3.1, um modelo de visão e linguagem com 24 bilhões de parâmetros, e envia o entendimento para um transformador de fluxo retificado. (O transformador de fluxo é o motor que converte ruído em imagem; “retificado” só indica que ele percorre um caminho mais direto e rápido.) O modelo [dev] completo chega a cerca de 32 bilhões de parâmetros. Um único checkpoint gera imagens novas e edita as existentes, sem depender de uma ferramenta separada.

Na prática, esse cérebro de linguagem maior entende de verdade um prompt denso. Peça “um copo d’água sobre uma mesa de madeira sob a luz da tarde” e ele acerta com mais frequência a refração, a sombra quente e direcional e os veios da madeira, porque o Mistral carrega conhecimento de mundo em vez de apenas inferir por estatística. O modelo também aceita prompts estruturados em campos nomeados (assunto, ambiente, iluminação, paleta de cores, estilo), um formato muito mais próximo de um briefing criativo do que de uma frase solta.

Dois números importam em produção. A saída nativa chega a 4 megapixels, resolução suficiente para web e a maioria das redes sociais sem upscaling, e cada geração pode ser condicionada por até 10 imagens de referência simultâneas — o mecanismo que mantém personagens e produtos consistentes.

As cinco variantes em resumo

É aqui que as páginas que apenas despejam especificações erram: as cinco variantes não formam uma escada de qualidade. Cada uma atende a um trabalho diferente. Os valores abaixo são os preços oficiais da API da Black Forest Labs por megapixel; um megapixel (MP) equivale aproximadamente a uma imagem de 1000x1000, portanto uma geração padrão de 1MP custa perto do valor indicado.

VarianteMelhor usoPreço da APILicençaSeu principal diferencial
[klein] 4BRodar na própria GPUa partir de $0.014/MPApache 2.0Uso comercial gratuito
[klein] 9BUso local com mais qualidadea partir de $0.015/MPNão comercialQualidade em uma máquina compacta
[pro]Produção hospedadaa partir de $0.03/MPProprietáriaRelação entre preço e qualidade
[flex]Tipografia, UI e infográficosa partir de $0.05/MPProprietáriaControle sobre a amostragem
[max]Peças hero e materiais impressosa partir de $0.07/MPProprietáriaQualidade máxima + grounding na web
[dev]Pesquisa local e fine-tuninggrátis (seu hardware)Não comercialPesos abertos de 32B

[klein] 4B é o ponto de partida indicado para a maioria dos designers. É a única variante sob a licença Apache 2.0, o que permite executá-la na própria máquina e vender o resultado sem restrições. Ela destila o grande modelo de 32B em 4 bilhões de parâmetros, funciona em uma placa de consumo com cerca de 8GB de VRAM (uma RTX 3090 ou 4070) e renderiza em menos de meio segundo. Hospedada na API da BFL, parte de $0.014/MP; na fal, também é possível alugar uma versão “Base” não destilada por $0.009/MP, que abre mão de velocidade em troca do ajuste de qualidade e do treinamento de LoRAs.

[pro] é a escolha padrão para produção. Por $0.03/MP na geração, ocupa o topo do ranking de imagens do LM Arena, com cerca de 1265 ELO na atualização v1.1, no mesmo nível do GPT Image. A API aceita até 8 imagens de referência e renderiza em quatro a oito segundos. Para gerar variações de anúncios ou fotos de produtos por um pipeline hospedado, esta é a opção a colocar na planilha.

Modelos FLUX.2 hospedados na fal
A fal hospeda todas as variantes do FLUX.2, inclusive a versão klein Base não destilada e mais barata

[flex] existe para trabalhar com texto. A maioria dos modelos de imagem ainda destrói a tipografia, e [flex] é a resposta da Black Forest Labs: ele expõe as etapas de amostragem e a escala de orientação, permitindo exigir mais legibilidade do modelo. Também foi ajustado para tipografia em vários níveis, infográficos com números reais, mockups de UI e composições com muito texto. Por $0.05/MP, é a variante certa quando a imagem é um cartaz, gráfico ou tela — não uma cena. Ela ainda aceita pesos LoRA, para que uma marca incorpore seu próprio sistema tipográfico.

[max] é a variante para impressão e peças hero. Traz a mesma arquitetura 32B operando em qualidade máxima, sem atalhos, a partir de $0.07/MP, além de um recurso ausente nas demais: grounding na web em tempo real. Durante a geração, pode pesquisar na internet para reproduzir corretamente a embalagem de um produto recém-lançado ou um acontecimento atual, em vez de inventar com base em dados de treinamento congelados. Use com parcimônia, naquela imagem que ganhará grande destaque.

[dev] é o laboratório aberto. Os pesos de 32 bilhões de parâmetros podem ser baixados gratuitamente no Hugging Face sob uma licença não comercial. No lançamento, era o modelo de imagem de pesos abertos mais capaz considerando o número de parâmetros. Não há endpoint hospedado pela BFL: é preciso executá-lo por conta própria. A precisão completa exige 80GB de memória de GPU, mas uma versão quantizada em 4 bits cabe em cerca de 20GB em uma RTX 4090. A quantização reduz o modelo ao armazenar seus números com menor precisão, trocando um pouco de qualidade por uma demanda de memória muito menor. Esta é a variante para quem faz fine-tuning e pesquisa, não para quem só quer gerar uma imagem.

Onde ele falha diante de um briefing real

Comecemos pelas limitações honestas, porque todas as variantes têm as suas. Em estética, ele é competente, mas não magnético. Rode o mesmo briefing no Midjourney e no FLUX.2; a imagem do Midjourney normalmente parece ter mais direção de arte, com iluminação melhor, atmosfera mais forte e a sensação de uma composição pensada. O FLUX.2 entrega algo correto e controlável, mas muitas vezes precisa de uma segunda rodada para parecer intencional. Na exploração de caminhos diferentes para um moodboard, essa diferença pesa.

A tipografia ainda falha fora do [flex]. As variantes-base dão conta de textos curtos e limpos, mas basta pedir um parágrafo, uma assinatura de logo ou letras em perspectiva para receber palavras sem sentido que parecem convincentes. [flex] reduz o problema, mas não o elimina. Trate o texto gerado como um placeholder a ser refeito no Figma ou Illustrator, nunca como arte-final.

Ele premia prompts densos e pune a preguiça. O cérebro Mistral foi projetado para instruções detalhadas e estruturadas. Um prompt de três palavras produz um resultado genérico; a melhora é real quando assunto, iluminação, paleta e composição aparecem em campos separados. Dá mais trabalho do que digitar uma atmosfera no Midjourney.

[dev] exige compromisso com hardware. “Pesos abertos” parece sinônimo de grátis até chegar a hora de calcular a GPU. Em uma 4090 com 4 bits, cada megapixel leva cerca de 15 segundos; com offloading em uma placa de 8GB, uma única imagem pode demorar um minuto ou mais. Para a maioria das equipes, os endpoints hospedados de klein ou pro custam menos que a eletricidade e o tempo de espera.

O ponto forte
O que faz bem
10 points

  • Controle de cor hexadecimal e múltiplas referências que a maioria dos concorrentes não oferece
  • klein 4B é realmente gratuito para uso comercial
  • Um único modelo para gerar e editar
  • Fine-tuning com LoRA para manter um estilo de marca fechado
  • Excelente fidelidade ao prompt graças ao cérebro de linguagem Mistral
  • Menos direção de arte do que Midjourney logo de saída
  • Renderização de texto ainda pouco confiável fora do [flex]
  • Exige prompts densos e estruturados para mostrar seu melhor
  • [dev] requer uma GPU robusta
  • Cinco variantes e três licenças tornam a oferta confusa

Qual variante escolher para o seu trabalho

A escolha certa depende menos do orçamento do que de onde o trabalho será executado e de quem precisará controlá-lo.

Seu cenárioA escolhaMotivo
Fundador solo / criador[klein] 4B (local ou hospedado)Uso comercial gratuito, roda em uma GPU gamer e é rápido o bastante para iterar
Marca de e-commerce[pro] via API hospedadaFotos e variações de produtos em escala, com consistência, por $0.03/MP
Agência / estúdio[flex] + [max][flex] para tipografia e UI; [max] para a peça hero
Equipe interna de produto[dev] com fine-tuningTreine uma LoRA com a marca, implante em ambiente privado e elimine o custo por chamada

A regra de decisão: se o resultado será vendido e gerado na sua própria infraestrutura, comece com [klein] 4B por causa da licença Apache 2.0. Só avance para outra variante quando um trabalho específico — tipografia, qualidade de peça hero ou precisão sobre fatos atuais da web — exigir. Não escolha [max] automaticamente só porque é a melhor: a tarifa é cinco vezes maior que a de klein por uma qualidade desnecessária para a maior parte da produção.

Para entender onde o FLUX.2 fica diante dos modelos proprietários, a comparação mais relevante é com o editor do Google: veja Nano Banana por dentro e entenda em quais edições limpas um modelo pensado desde a origem para fotografia leva vantagem.

O FLUX.2 é grátis?

Em parte. Os modelos [dev] e [klein] são distribuídos como pesos abertos para baixar e rodar gratuitamente, e a licença Apache 2.0 do [klein] 4B permite até vender o que você gerar. As variantes hospedadas ([pro], [flex], [max]) são cobradas por megapixel pela API da Black Forest Labs, de $0.03 a $0.07/MP.

O FLUX.2 é open source?

Os pesos de [dev] e [klein] são abertos; o código e os pesos de [pro]/[max], não. Somente [klein] 4B usa uma licença realmente permissiva (Apache 2.0). [dev] e [klein] 9B adotam uma licença não comercial que restringe os pesos, mas permite usar o resultado comercialmente.

Quanto custa o FLUX.2?

Na API da BFL, o preço parte de $0.014/MP para [klein] e chega a $0.07/MP para [max], com [pro] a $0.03/MP como o ponto ideal para produção. Ao rodar [dev] ou [klein] na própria GPU, a geração é gratuita, fora o custo de hardware e energia.

Para que serve o FLUX.2?

Para imagens de produção controláveis e consistentes com a marca: variações de anúncios, fotografia de produtos, mockups de UI e qualquer projeto que exija cores travadas ou a repetição de um personagem ou produto em vários quadros. Ele é menos forte na exploração atmosférica e dirigida artisticamente, terreno em que Midjourney lidera.

Quer receber a análise do próximo modelo na semana do lançamento, com preços reais e critério de qualidade em vez de hype? Assine a newsletter e acompanhe cada edição por e-mail.

Última atualização

4 de set. de 2026

CategoriaDesign

Prefira este site no Google

Adicionar omidsaffari.com como fonte preferida na Busca do Google

Marque omidsaffari.com como fonte preferida e o Google destaca o site para você em Top Stories, AI Overviews e AI Mode.

Newsletter

Uma carta, todo domingo. Sistemas que funcionam, não hot takes.

Build logs, sistemas em produção e notas de campo de um portfólio de ventures de IA.

Semanal. Sem spam. Cancele quando quiser.