Review do Hy4 Preview: Tencent Hunyuan 770B MoE, contexto 1M, API, hardware local e limites NSFW
O Hy4 Preview é o novo modelo aberto da Tencent Hunyuan voltado para raciocínio com contexto longo, agentes de código, RAG e fluxos empresariais. Os…
O Hy4 Preview é o novo modelo aberto da Tencent Hunyuan voltado para raciocínio com contexto longo, agentes de código, RAG e fluxos empresariais. Os números principais são grandes: arquitetura MoE com 770B parâmetros totais, cerca de 49B parâmetros ativos e janela de contexto de 1M tokens.
Na prática, a avaliação precisa ser equilibrada. O Hy4 Preview é promissor, mas não é um LLM local leve para qualquer computador. Hoje faz mais sentido testá-lo por API, via OpenRouter ou Tencent Cloud TokenHub, antes de pensar em implantação própria.
Também não é correto tratá-lo como modelo NSFW ou sem censura. As versões oficiais aplicam filtros de segurança, e pesos abertos não significam liberdade irrestrita para conteúdo adulto.
Índice
Veredito rápido
| Item | Avaliação |
|---|---|
| Melhor para | Documentos longos, agentes de código, RAG, conhecimento empresarial e raciocínio em várias etapas |
| Tipo | LLM MoE aberto, 770B totais e cerca de 49B ativos |
| Contexto | 1M tokens |
| Acesso | OpenRouter, Tencent Cloud TokenHub, produtos Tencent e pesos no Hugging Face |
| Licença | Apache-2.0 no GitHub e Hugging Face |
| Atenção | Versão preview, implantação local pesada e filtros NSFW fortes |
Para comparar o posicionamento, veja também os reviews de Qwen 3.8, Gemma 4 e GLM-5.3-Flash. O Hy4 Preview mira agentes empresariais de contexto longo, não um assistente local leve.
O que é o Hy4 Preview

O Hy4 Preview é um LLM em fase preview da Tencent Hunyuan. As páginas oficiais indicam modelo MoE com 770B parâmetros totais, aproximadamente 49B ativos por inferência e contexto de 1M tokens. Em relação ao Hy3 Preview, com cerca de 295B totais, 21B ativos e 256K de contexto, o avanço é grande.
MoE significa Mixture of Experts: o modelo ativa apenas parte dos especialistas internos para cada entrada. Isso ajuda na eficiência, mas não transforma o Hy4 Preview em um modelo pequeno.
Uso online, API e downloads

Os pesos estão em Tencent-Hunyuan/Hy4-preview no GitHub e tencent/Hy4-preview no Hugging Face. Para reduzir memória, existe também tencent/Hy4-preview-FP8.
Para testar online, OpenRouter é o caminho mais simples. No ecossistema Tencent, confira Tencent Cloud TokenHub e serviços como Tencent Yuanbao.
Principais recursos
O Hy4 Preview foi pensado para entradas longas e tarefas contínuas. Uma janela de 1M tokens pode ser útil para repositórios de código, contratos, relatórios, documentação técnica, atas e bases de conhecimento grandes.
| Recurso | Por que importa |
|---|---|
| 770B MoE / 49B ativos | Grande capacidade com ativação parcial por token |
| Contexto 1M | Bom para documentos longos, RAG e análise de repositórios |
| Pesos abertos | Permite pesquisa, implantação e integração |
| vLLM / SGLang | Mais adequado a inferência em servidor |
| Ecossistema Tencent | Potencial integração com escritório, código e busca |
Desempenho e experiência real

Os benchmarks iniciais devem ser lidos com cautela. Resultados oficiais ajudam a entender a proposta, mas ainda faltam testes independentes de longo prazo.
Vale testá-lo em tarefas que realmente usem a escala: análise de repositórios, comparação de documentos, extração estruturada, chamadas de ferramentas e memória de contexto longo.
Hardware local necessário
A implantação local é o maior obstáculo. Mesmo com MoE, o Hy4 Preview continua sendo um modelo de 770B parâmetros totais. BF16 é cenário de servidores multi-GPU, e FP8 ainda é pesado para usuários domésticos.
| Ambiente | Expectativa realista |
|---|---|
| GPU de 8-24GB | Não é prático para o modelo completo; prefira API ou modelos menores |
| GPU única de 48GB | Ainda limitada; depende de quantização e offload |
| Servidor com várias GPUs de 80GB | Caminho realista para implantação séria |
| Inferência em nuvem | Mais prática para avaliar rapidamente |
| Frameworks | Priorize vLLM e SGLang conforme instruções oficiais |
Comparação com outros modelos
| Modelo | Força | Limitação | Melhor uso |
|---|---|---|---|
| Hy4 Preview | MoE enorme, contexto 1M, foco em agentes | Preview e hardware pesado | Agentes empresariais, RAG, documentos longos |
| Qwen 3.8 | Ecossistema local forte e bom multilingue | Menos extremo em contexto e escala | LLM local, código, multilingue |
| GLM-5.3-Flash | API eficiente e foco agentic | Comunidade ainda crescendo | Automação e produtos via API |
| Gemma 4 | Mais fácil de usar localmente | Não é MoE gigante de 1M contexto | Assistente local equilibrado |
| Llama / Mistral | Ferramentas e comunidade globais maduras | Nem sempre lideram em contexto longo recente | Implantação local geral |
NSFW e limites de segurança
O Hy4 Preview não deve ser considerado uma opção NSFW. Versões oficiais da Tencent e endpoints de API tendem a bloquear conteúdo sexual explícito, violência gráfica, instruções ilegais e outras categorias sensíveis.
Podem surgir variantes uncensored da comunidade, mas o tamanho do modelo torna o fine-tuning caro. Para roleplay adulto ou escrita sem filtros, modelos menores especializados são mais práticos hoje.
O que acompanhar
Acompanhe benchmarks independentes, testes de contexto longo, receitas de implantação com vLLM/SGLang, quantizações, latência real, custo por uso e estabilidade em agentes longos.
Perguntas frequentes
O Hy4 Preview é open source?
Sim. GitHub e Hugging Face mostram recursos públicos e licença Apache-2.0.
Onde posso testar online?
OpenRouter é a entrada mais simples. Usuários da Tencent Cloud podem ver TokenHub.
Funciona em PC gamer?
Não de forma realista para o modelo completo. API ou modelos menores são melhores para a maioria.
É melhor que Qwen 3.8?
Depende do uso. Hy4 Preview mira contexto longo e agentes empresariais; Qwen 3.8 é mais confortável localmente.
É bom para NSFW?
Não. As versões oficiais têm filtros fortes.
Referências
- Repositório Tencent-Hunyuan/Hy4-preview
- tencent/Hy4-preview no Hugging Face
- tencent/Hy4-preview-FP8
- OpenRouter Tencent: Hy4 preview
- Relatório AIbase
- Tencent Cloud TokenHub
Conclusão
O Hy4 Preview é uma proposta aberta ambiciosa para contexto longo e agentes empresariais. 770B MoE, 1M tokens e pesos abertos formam uma combinação importante.
Ainda assim, ele não é simples para uso local nem permissivo para NSFW. O melhor caminho é testar por API e comparar com Qwen 3.8, GLM-5.3-Flash e Gemma 4 em tarefas reais.