Review do Hy4 Preview: Tencent Hunyuan 770B MoE, contexto 1M, API, hardware local e limites NSFW

O Hy4 Preview é o novo modelo aberto da Tencent Hunyuan voltado para raciocínio com contexto longo, agentes de código, RAG e fluxos empresariais. Os…

schedule
article 6 min de leitura
Review do Hy4 Preview: Tencent Hunyuan 770B MoE, contexto 1M, API, hardware local e limites NSFW cover image

O Hy4 Preview é o novo modelo aberto da Tencent Hunyuan voltado para raciocínio com contexto longo, agentes de código, RAG e fluxos empresariais. Os números principais são grandes: arquitetura MoE com 770B parâmetros totais, cerca de 49B parâmetros ativos e janela de contexto de 1M tokens.

Na prática, a avaliação precisa ser equilibrada. O Hy4 Preview é promissor, mas não é um LLM local leve para qualquer computador. Hoje faz mais sentido testá-lo por API, via OpenRouter ou Tencent Cloud TokenHub, antes de pensar em implantação própria.

Também não é correto tratá-lo como modelo NSFW ou sem censura. As versões oficiais aplicam filtros de segurança, e pesos abertos não significam liberdade irrestrita para conteúdo adulto.

Veredito rápido

Item Avaliação
Melhor para Documentos longos, agentes de código, RAG, conhecimento empresarial e raciocínio em várias etapas
Tipo LLM MoE aberto, 770B totais e cerca de 49B ativos
Contexto 1M tokens
Acesso OpenRouter, Tencent Cloud TokenHub, produtos Tencent e pesos no Hugging Face
Licença Apache-2.0 no GitHub e Hugging Face
Atenção Versão preview, implantação local pesada e filtros NSFW fortes

Para comparar o posicionamento, veja também os reviews de Qwen 3.8, Gemma 4 e GLM-5.3-Flash. O Hy4 Preview mira agentes empresariais de contexto longo, não um assistente local leve.

O que é o Hy4 Preview

Captura do repositório oficial do Hy4 Preview no GitHub
O repositório oficial da Tencent mostra README, licença e documentação em inglês e chinês.

O Hy4 Preview é um LLM em fase preview da Tencent Hunyuan. As páginas oficiais indicam modelo MoE com 770B parâmetros totais, aproximadamente 49B ativos por inferência e contexto de 1M tokens. Em relação ao Hy3 Preview, com cerca de 295B totais, 21B ativos e 256K de contexto, o avanço é grande.

MoE significa Mixture of Experts: o modelo ativa apenas parte dos especialistas internos para cada entrada. Isso ajuda na eficiência, mas não transforma o Hy4 Preview em um modelo pequeno.

Uso online, API e downloads

Captura do Hy4 Preview no Hugging Face
A página do Hugging Face mostra tencent/Hy4-preview, licença Apache-2.0, tags e arquivos do modelo.

Os pesos estão em Tencent-Hunyuan/Hy4-preview no GitHub e tencent/Hy4-preview no Hugging Face. Para reduzir memória, existe também tencent/Hy4-preview-FP8.

Para testar online, OpenRouter é o caminho mais simples. No ecossistema Tencent, confira Tencent Cloud TokenHub e serviços como Tencent Yuanbao.

Principais recursos

O Hy4 Preview foi pensado para entradas longas e tarefas contínuas. Uma janela de 1M tokens pode ser útil para repositórios de código, contratos, relatórios, documentação técnica, atas e bases de conhecimento grandes.

Recurso Por que importa
770B MoE / 49B ativos Grande capacidade com ativação parcial por token
Contexto 1M Bom para documentos longos, RAG e análise de repositórios
Pesos abertos Permite pesquisa, implantação e integração
vLLM / SGLang Mais adequado a inferência em servidor
Ecossistema Tencent Potencial integração com escritório, código e busca

Desempenho e experiência real

Captura do Hy4 Preview no OpenRouter
O OpenRouter lista contexto 1M, provedor, data de lançamento e preços públicos de API.

Os benchmarks iniciais devem ser lidos com cautela. Resultados oficiais ajudam a entender a proposta, mas ainda faltam testes independentes de longo prazo.

Vale testá-lo em tarefas que realmente usem a escala: análise de repositórios, comparação de documentos, extração estruturada, chamadas de ferramentas e memória de contexto longo.

Hardware local necessário

A implantação local é o maior obstáculo. Mesmo com MoE, o Hy4 Preview continua sendo um modelo de 770B parâmetros totais. BF16 é cenário de servidores multi-GPU, e FP8 ainda é pesado para usuários domésticos.

Ambiente Expectativa realista
GPU de 8-24GB Não é prático para o modelo completo; prefira API ou modelos menores
GPU única de 48GB Ainda limitada; depende de quantização e offload
Servidor com várias GPUs de 80GB Caminho realista para implantação séria
Inferência em nuvem Mais prática para avaliar rapidamente
Frameworks Priorize vLLM e SGLang conforme instruções oficiais

Comparação com outros modelos

Modelo Força Limitação Melhor uso
Hy4 Preview MoE enorme, contexto 1M, foco em agentes Preview e hardware pesado Agentes empresariais, RAG, documentos longos
Qwen 3.8 Ecossistema local forte e bom multilingue Menos extremo em contexto e escala LLM local, código, multilingue
GLM-5.3-Flash API eficiente e foco agentic Comunidade ainda crescendo Automação e produtos via API
Gemma 4 Mais fácil de usar localmente Não é MoE gigante de 1M contexto Assistente local equilibrado
Llama / Mistral Ferramentas e comunidade globais maduras Nem sempre lideram em contexto longo recente Implantação local geral

NSFW e limites de segurança

O Hy4 Preview não deve ser considerado uma opção NSFW. Versões oficiais da Tencent e endpoints de API tendem a bloquear conteúdo sexual explícito, violência gráfica, instruções ilegais e outras categorias sensíveis.

Podem surgir variantes uncensored da comunidade, mas o tamanho do modelo torna o fine-tuning caro. Para roleplay adulto ou escrita sem filtros, modelos menores especializados são mais práticos hoje.

O que acompanhar

Acompanhe benchmarks independentes, testes de contexto longo, receitas de implantação com vLLM/SGLang, quantizações, latência real, custo por uso e estabilidade em agentes longos.

Perguntas frequentes

O Hy4 Preview é open source?

Sim. GitHub e Hugging Face mostram recursos públicos e licença Apache-2.0.

Onde posso testar online?

OpenRouter é a entrada mais simples. Usuários da Tencent Cloud podem ver TokenHub.

Funciona em PC gamer?

Não de forma realista para o modelo completo. API ou modelos menores são melhores para a maioria.

É melhor que Qwen 3.8?

Depende do uso. Hy4 Preview mira contexto longo e agentes empresariais; Qwen 3.8 é mais confortável localmente.

É bom para NSFW?

Não. As versões oficiais têm filtros fortes.

Referências

Conclusão

O Hy4 Preview é uma proposta aberta ambiciosa para contexto longo e agentes empresariais. 770B MoE, 1M tokens e pesos abertos formam uma combinação importante.

Ainda assim, ele não é simples para uso local nem permissivo para NSFW. O melhor caminho é testar por API e comparar com Qwen 3.8, GLM-5.3-Flash e Gemma 4 em tarefas reais.

Tags de Avaliação

#contexto 1M #Hunyuan #Hy4 Preview #LLM open source #MoE #NSFW #Tencent Hunyuan

Entrar

OU

Criar conta

A senha deve ter entre 8 e 20 caracteres e conter letras e números

OU

Esqueceu a Senha

A senha deve ter entre 8 e 20 caracteres e conter letras e números