Qwen-Image-2.1: análise de imagens transparentes, edição, API e NSFW
Conheça o Qwen-Image-2.1: PNG transparente, edição com referências, relatos de uso, preços da API, ComfyUI, VRAM e limites da licença de pesquisa.
O diferencial do Qwen-Image-2.1 é criar recursos visuais que você também pode editar. Transparência nativa, várias referências e ajustes em partes de uma foto fazem dele uma opção interessante para pesquisar figurinhas, recortes de produtos e variações de personagens.
Dois cuidados pesam na escolha: os pesos usam uma licença de pesquisa e os 7B anunciados representam apenas o gerador visual. Teste a demonstração antes de comprar uma GPU e esclareça a licença antes de usar o modelo em projetos pagos. Informações e preços conferidos em 24 de setembro de 2026.
O que muda nesta versão
Lançado em 20 de setembro de 2026, o Qwen-Image-2.1 reúne geração e edição. Os destaques são imagens RGBA, até dez referências e alterações locais orientadas por marcações ou máscaras. A equipe também anuncia melhorias em letras, iluminação de retratos e texturas; isso não garante superioridade em todos os pedidos.

| Recurso | Utilidade | Ponto de atenção |
|---|---|---|
| RGBA nativo | Criar recursos com fundo transparente | Verificar o canal alfa, não uma quadrícula desenhada |
| Até 10 referências | Combinar pessoas, roupas ou objetos | Mais complexidade e consumo de memória |
| 2K nativo | Saída quadrada documentada de 2048 × 2048 | A resolução aumenta a carga |
| Gerador de 7B | Componente visual mais compacto | Também entram o codificador Qwen3-VL 8B e o VAE |
Salve como PNG e coloque o resultado sobre fundos claros e escuros. Cabelo, vidro e sombras suaves merecem inspeção. O limite de dez referências não promete dez identidades perfeitas ou a preservação de toda letra em uma embalagem.
Relatos reais: edição útil, qualidade variável
A Europa Press noticiou o lançamento, mas cobertura de anúncio não é teste independente. No relato do usuário TheTechnoX no Hugging Face, uma RTX 4060 Ti de 16GB executou uma configuração INT8 no ComfyUI e realizou edições localizadas.
O autor relata cerca de 20 segundos para gerar, 60 para editar e pico de aproximadamente 15GB de VRAM. Sem resolução e passos totalmente especificados, isso demonstra uma possibilidade de uso, não o desempenho garantido de qualquer PC.
Uma avaliação no Reddit elogia mudanças de expressão, pose e fundo, mas aponta tons amarelados, granulação e aparência artificial em algumas imagens. Combinações complexas também foram menos convincentes. Nossa recomendação é começar por transparência e edições bem delimitadas; estes são relatos de terceiros, não medições de GPU realizadas pelo AirMore.
Onde usar online e preços da API
A demonstração oficial no Hugging Face permite testar a versão exata. Aceita prompts em inglês e chinês, imagens de entrada e aprimoramento do prompt. A capacidade compartilhada pode mudar; não há garantia verificada de acesso ilimitado ou disponibilidade empresarial.

- Para gerar por texto, comece sem imagem e descreva um objetivo claro.
- Para editar, envie uma imagem sua e diga o que deve mudar e permanecer.
- Peça RGBA e fundo transparente quando necessário; salve em PNG.
- Confira o texto acrescentado por Enhance prompt e desative a opção se distorcer o pedido.
- Clique em Generate image e examine letras e bordas no tamanho original.
O reAPI é um provedor terceirizado com preço de US$0,02 por imagem 1K e US$0,04 por imagem 2K. Como referência, isso equivale a cerca de R$0,10 e R$0,20. Cem imagens saem por aproximadamente R$10,23 ou R$20,47; em euros, cerca de €1,75 ou €3,51. Não é uma tabela oficial da Alibaba.

Conversões indicativas de 24 de setembro de 2026: US$1 ≈ R$5,1169 ou €0,8774. Impostos e taxas de pagamento podem alterar o total; não é uma promessa de cobrança em moeda local. A API usa qwen-image-2.1, com envio de tarefa e consulta posterior. Também há instruções de API local com vLLM-Omni, mas você administra e paga a infraestrutura.
ComfyUI: arquivos, workflow e VRAM
Atualize o ComfyUI e use os arquivos do Comfy-Org, junto do workflow oficial de texto para imagem ou edição. Não misture automaticamente o VAE e os nós de versões antigas.

Exemplo de organização para INT8. Se baixar BF16, escolha os nomes correspondentes nos nós de carregamento:
ComfyUI/models/diffusion_models/
qwen_image_2.1_int8_convrot.safetensors
ComfyUI/models/text_encoders/
qwen3vl_8b_int8_convrot.safetensors
ComfyUI/models/vae/
qwen_image_2.1_vae_bf16.safetensors - Importe o JSON oficial.
- Coloque gerador, codificador e VAE nas pastas e atualize a lista de modelos.
- Selecione os arquivos corretos e, para edição, a imagem de origem.
- Comece em 1024 × 1024 com uma imagem antes de subir resolução e referências.
- Registre seed, precisão e parâmetros para comparar alterações.
Não existe um mínimo universal de VRAM. A medição do vLLM em GB300 chega a aproximadamente 34GB em uma configuração BF16 a 1024 × 1024 e 40 passos. É hardware de datacenter. O caso de 16GB usa quantização e outro ambiente, sem garantir 2K com dez referências.
Quantização e descarregamento para CPU podem ajudar, mas alteram velocidade ou qualidade. Reserve RAM e espaço SSD. Os modelos extras de aprimoramento de prompt, de 9B, são opcionais e podem ficar para depois do primeiro teste.
Comparação com alternativas
| Modelo | Quando considerar | Principal limite |
|---|---|---|
| Qwen-Image-2.1 | Transparência e geração/edição integradas | Licença de pesquisa e carga variável |
| Qwen-Image-Edit-2511 | Manter um fluxo de edição já confiável | Extensões antigas não são automaticamente compatíveis |
| FLUX.2 [klein] 4B | Iteração rápida e pesos 4B sob Apache-2.0 | A variante 9B possui outra licença |

Compare mudanças de roupa com preservação de rosto, manutenção de rótulos e troca de fundo. Um modelo pode melhorar uma tarefa e piorar outra; mantenha a solução antiga até concluir essa comparação.

A API klein 4B começa em US$0,014 para o primeiro megapixel, com cobranças adicionais por pixels e referências. Não é uma comparação direta com os pacotes 1K/2K do reAPI. Experimente 2.1 para transparência; avalie klein 4B quando rapidez ou licença permissiva dos pesos forem mais importantes. Não se trata de um ranking de qualidade medido nas mesmas condições.
Leia também: análise da família Qwen Image
NSFW e uso comercial
Executar localmente não significa suporte oficial irrestrito a NSFW. Relatos descrevem diferenças entre geração e edição; o reescritor de prompts e a moderação do provedor também interferem. O reAPI informa que analisa entradas e saídas, portanto suas regras continuam válidas.
A Qwen Research License limita os materiais a pesquisa/avaliação e pede licença separada para uso comercial. O contato informado é model-business@notice.qwencloud.com. Não aplique a licença Apache-2.0 de outro Qwen a esta versão nem suponha que pagar uma API resolve todos os direitos de uso.
Prompts e aplicações que valem um teste
- Figurinhas: descreva um objeto, material, luz e transparência, sem acrescentar um cenário incompatível.
- Produto: diga o que preservar: forma, texto, reflexos e ângulo. Inspecione depois.
- Referências: atribua uma função à primeira e à segunda imagem; adicione outras aos poucos.
- Texto: use aspas para a frase exata e informe a posição. Revise acentos e letras pequenas.
- Anime e retratos: confira anatomia e identidade em edições sucessivas; não existe garantia automática de um estilo específico.
Exemplo: “Uma figurinha de flor laranja feita de papel, bordas nítidas, fundo RGBA transparente e espaço ao redor; sem texto”. Para editar: “Troque apenas o fundo azul por verde-claro; preserve garrafa, rótulo, reflexos e enquadramento”. São sugestões de prompt, não resultados de benchmark.
Perguntas frequentes e conclusão
É gratuito?
Os pesos não cobram por imagem, mas GPU, energia e aluguel têm custo. A licença restringe o uso; plataformas online possuem regras próprias.
Uma GPU de 8GB basta?
7B não determina a resposta. Codificador, VAE e dados intermediários consomem memória. Procure medições com sua configuração exata.
Posso usar LoRAs antigos?
Verifique suporte explícito à arquitetura 2.1. Comece com o workflow oficial sem extensões e só depois acrescente componentes compatíveis.
Por que o arquivo não é transparente?
Confira formato PNG, canal alfa e instruções conflitantes de fundo. JPEG não mantém transparência. Teste o arquivo sobre duas cores.
Vale migrar?
Vale experimentar para pesquisa de transparência e edição localizada. Use primeiro a demo e repita algumas tarefas úteis antes de investir. Consistência, velocidade e licença devem estar resolvidas antes de abandonar o modelo anterior.
Em trabalho remunerado, a licença entra na escolha desde o início. Uma imagem bonita, sozinha, não comprova que a ferramenta atende ao projeto.