Qwen-Image-2.1: análise de imagens transparentes, edição, API e NSFW

Conheça o Qwen-Image-2.1: PNG transparente, edição com referências, relatos de uso, preços da API, ComfyUI, VRAM e limites da licença de pesquisa.

schedule
article 8 min de leitura
Qwen-Image-2.1: análise de imagens transparentes, edição, API e NSFW — Ilustração editorial de capa; não é uma saída de teste do Qwen.

O diferencial do Qwen-Image-2.1 é criar recursos visuais que você também pode editar. Transparência nativa, várias referências e ajustes em partes de uma foto fazem dele uma opção interessante para pesquisar figurinhas, recortes de produtos e variações de personagens.

Dois cuidados pesam na escolha: os pesos usam uma licença de pesquisa e os 7B anunciados representam apenas o gerador visual. Teste a demonstração antes de comprar uma GPU e esclareça a licença antes de usar o modelo em projetos pagos. Informações e preços conferidos em 24 de setembro de 2026.

O que muda nesta versão

Lançado em 20 de setembro de 2026, o Qwen-Image-2.1 reúne geração e edição. Os destaques são imagens RGBA, até dez referências e alterações locais orientadas por marcações ou máscaras. A equipe também anuncia melhorias em letras, iluminação de retratos e texturas; isso não garante superioridade em todos os pedidos.

A ficha oficial identifica o modelo e a licença de pesquisa.
A ficha oficial identifica o modelo e a licença de pesquisa.
Recurso Utilidade Ponto de atenção
RGBA nativo Criar recursos com fundo transparente Verificar o canal alfa, não uma quadrícula desenhada
Até 10 referências Combinar pessoas, roupas ou objetos Mais complexidade e consumo de memória
2K nativo Saída quadrada documentada de 2048 × 2048 A resolução aumenta a carga
Gerador de 7B Componente visual mais compacto Também entram o codificador Qwen3-VL 8B e o VAE

Salve como PNG e coloque o resultado sobre fundos claros e escuros. Cabelo, vidro e sombras suaves merecem inspeção. O limite de dez referências não promete dez identidades perfeitas ou a preservação de toda letra em uma embalagem.

Relatos reais: edição útil, qualidade variável

A Europa Press noticiou o lançamento, mas cobertura de anúncio não é teste independente. No relato do usuário TheTechnoX no Hugging Face, uma RTX 4060 Ti de 16GB executou uma configuração INT8 no ComfyUI e realizou edições localizadas.

O autor relata cerca de 20 segundos para gerar, 60 para editar e pico de aproximadamente 15GB de VRAM. Sem resolução e passos totalmente especificados, isso demonstra uma possibilidade de uso, não o desempenho garantido de qualquer PC.

Uma avaliação no Reddit elogia mudanças de expressão, pose e fundo, mas aponta tons amarelados, granulação e aparência artificial em algumas imagens. Combinações complexas também foram menos convincentes. Nossa recomendação é começar por transparência e edições bem delimitadas; estes são relatos de terceiros, não medições de GPU realizadas pelo AirMore.

Onde usar online e preços da API

A demonstração oficial no Hugging Face permite testar a versão exata. Aceita prompts em inglês e chinês, imagens de entrada e aprimoramento do prompt. A capacidade compartilhada pode mudar; não há garantia verificada de acesso ilimitado ou disponibilidade empresarial.

A demonstração oficial reúne imagens de entrada e aprimoramento do prompt.
A demonstração oficial reúne imagens de entrada e aprimoramento do prompt.
  1. Para gerar por texto, comece sem imagem e descreva um objetivo claro.
  2. Para editar, envie uma imagem sua e diga o que deve mudar e permanecer.
  3. Peça RGBA e fundo transparente quando necessário; salve em PNG.
  4. Confira o texto acrescentado por Enhance prompt e desative a opção se distorcer o pedido.
  5. Clique em Generate image e examine letras e bordas no tamanho original.

O reAPI é um provedor terceirizado com preço de US$0,02 por imagem 1K e US$0,04 por imagem 2K. Como referência, isso equivale a cerca de R$0,10 e R$0,20. Cem imagens saem por aproximadamente R$10,23 ou R$20,47; em euros, cerca de €1,75 ou €3,51. Não é uma tabela oficial da Alibaba.

O reAPI disponibiliza geração online e acesso por API.
O reAPI disponibiliza geração online e acesso por API.

Conversões indicativas de 24 de setembro de 2026: US$1 ≈ R$5,1169 ou €0,8774. Impostos e taxas de pagamento podem alterar o total; não é uma promessa de cobrança em moeda local. A API usa qwen-image-2.1, com envio de tarefa e consulta posterior. Também há instruções de API local com vLLM-Omni, mas você administra e paga a infraestrutura.

ComfyUI: arquivos, workflow e VRAM

Atualize o ComfyUI e use os arquivos do Comfy-Org, junto do workflow oficial de texto para imagem ou edição. Não misture automaticamente o VAE e os nós de versões antigas.

O Comfy-Org oferece os arquivos compatíveis e workflows oficiais.
O Comfy-Org oferece os arquivos compatíveis e workflows oficiais.

Exemplo de organização para INT8. Se baixar BF16, escolha os nomes correspondentes nos nós de carregamento:

ComfyUI/models/diffusion_models/
qwen_image_2.1_int8_convrot.safetensors
ComfyUI/models/text_encoders/
qwen3vl_8b_int8_convrot.safetensors
ComfyUI/models/vae/
qwen_image_2.1_vae_bf16.safetensors
  1. Importe o JSON oficial.
  2. Coloque gerador, codificador e VAE nas pastas e atualize a lista de modelos.
  3. Selecione os arquivos corretos e, para edição, a imagem de origem.
  4. Comece em 1024 × 1024 com uma imagem antes de subir resolução e referências.
  5. Registre seed, precisão e parâmetros para comparar alterações.

Não existe um mínimo universal de VRAM. A medição do vLLM em GB300 chega a aproximadamente 34GB em uma configuração BF16 a 1024 × 1024 e 40 passos. É hardware de datacenter. O caso de 16GB usa quantização e outro ambiente, sem garantir 2K com dez referências.

Quantização e descarregamento para CPU podem ajudar, mas alteram velocidade ou qualidade. Reserve RAM e espaço SSD. Os modelos extras de aprimoramento de prompt, de 9B, são opcionais e podem ficar para depois do primeiro teste.

Comparação com alternativas

Modelo Quando considerar Principal limite
Qwen-Image-2.1 Transparência e geração/edição integradas Licença de pesquisa e carga variável
Qwen-Image-Edit-2511 Manter um fluxo de edição já confiável Extensões antigas não são automaticamente compatíveis
FLUX.2 [klein] 4B Iteração rápida e pesos 4B sob Apache-2.0 A variante 9B possui outra licença
O modelo 2511 é uma referência útil para comparar tarefas conhecidas.
O modelo 2511 é uma referência útil para comparar tarefas conhecidas.

Compare mudanças de roupa com preservação de rosto, manutenção de rótulos e troca de fundo. Um modelo pode melhorar uma tarefa e piorar outra; mantenha a solução antiga até concluir essa comparação.

O FLUX.2 klein possui pesos locais e API oficial.
O FLUX.2 klein possui pesos locais e API oficial.

A API klein 4B começa em US$0,014 para o primeiro megapixel, com cobranças adicionais por pixels e referências. Não é uma comparação direta com os pacotes 1K/2K do reAPI. Experimente 2.1 para transparência; avalie klein 4B quando rapidez ou licença permissiva dos pesos forem mais importantes. Não se trata de um ranking de qualidade medido nas mesmas condições.

Leia também: análise da família Qwen Image

NSFW e uso comercial

Executar localmente não significa suporte oficial irrestrito a NSFW. Relatos descrevem diferenças entre geração e edição; o reescritor de prompts e a moderação do provedor também interferem. O reAPI informa que analisa entradas e saídas, portanto suas regras continuam válidas.

A Qwen Research License limita os materiais a pesquisa/avaliação e pede licença separada para uso comercial. O contato informado é model-business@notice.qwencloud.com. Não aplique a licença Apache-2.0 de outro Qwen a esta versão nem suponha que pagar uma API resolve todos os direitos de uso.

Prompts e aplicações que valem um teste

  • Figurinhas: descreva um objeto, material, luz e transparência, sem acrescentar um cenário incompatível.
  • Produto: diga o que preservar: forma, texto, reflexos e ângulo. Inspecione depois.
  • Referências: atribua uma função à primeira e à segunda imagem; adicione outras aos poucos.
  • Texto: use aspas para a frase exata e informe a posição. Revise acentos e letras pequenas.
  • Anime e retratos: confira anatomia e identidade em edições sucessivas; não existe garantia automática de um estilo específico.

Exemplo: “Uma figurinha de flor laranja feita de papel, bordas nítidas, fundo RGBA transparente e espaço ao redor; sem texto”. Para editar: “Troque apenas o fundo azul por verde-claro; preserve garrafa, rótulo, reflexos e enquadramento”. São sugestões de prompt, não resultados de benchmark.

Perguntas frequentes e conclusão

É gratuito?

Os pesos não cobram por imagem, mas GPU, energia e aluguel têm custo. A licença restringe o uso; plataformas online possuem regras próprias.

Uma GPU de 8GB basta?

7B não determina a resposta. Codificador, VAE e dados intermediários consomem memória. Procure medições com sua configuração exata.

Posso usar LoRAs antigos?

Verifique suporte explícito à arquitetura 2.1. Comece com o workflow oficial sem extensões e só depois acrescente componentes compatíveis.

Por que o arquivo não é transparente?

Confira formato PNG, canal alfa e instruções conflitantes de fundo. JPEG não mantém transparência. Teste o arquivo sobre duas cores.

Vale migrar?

Vale experimentar para pesquisa de transparência e edição localizada. Use primeiro a demo e repita algumas tarefas úteis antes de investir. Consistência, velocidade e licença devem estar resolvidas antes de abandonar o modelo anterior.

Em trabalho remunerado, a licença entra na escolha desde o início. Uma imagem bonita, sozinha, não comprova que a ferramenta atende ao projeto.

Tags de Avaliação

#ComfyUI #NSFW #Qwen #Qwen-Image-2.1

Entrar

OU

Criar conta

A senha deve ter entre 8 e 20 caracteres e conter letras e números

OU

Esqueceu a Senha

A senha deve ter entre 8 e 20 caracteres e conter letras e números