Avis Hy4 Preview : Tencent Hunyuan 770B MoE, contexte 1M, API, matériel local et limites NSFW
Hy4 Preview est le nouveau modèle ouvert de Tencent Hunyuan pour le raisonnement à long contexte, les agents de code, le RAG et les workflows…
Hy4 Preview est le nouveau modèle ouvert de Tencent Hunyuan pour le raisonnement à long contexte, les agents de code, le RAG et les workflows d’entreprise. Ses chiffres sont ambitieux : architecture MoE avec 770B paramètres au total, environ 49B paramètres actifs et une fenêtre de contexte de 1M tokens.
En pratique, il faut rester mesuré. Hy4 Preview est prometteur, mais ce n’est pas un petit LLM local pour PC grand public. Le plus logique est de le tester via API, avec OpenRouter ou Tencent Cloud TokenHub, avant d’envisager un déploiement privé.
Il ne faut pas non plus le présenter comme un modèle NSFW ou non censuré. Les versions officielles appliquent des garde-fous, et les poids ouverts ne signifient pas une liberté totale pour les contenus adultes.
Sommaire
Verdict rapide
| Point | Évaluation |
|---|---|
| Idéal pour | Documents longs, agents de code, RAG, connaissance d’entreprise, raisonnement multi-étapes |
| Type | LLM MoE ouvert, 770B au total et environ 49B actifs |
| Contexte | 1M tokens |
| Accès | OpenRouter, Tencent Cloud TokenHub, produits Tencent et poids Hugging Face |
| Licence | Apache-2.0 sur GitHub et Hugging Face |
| À retenir | Version preview, déploiement local lourd, filtres NSFW stricts |
Pour le situer, comparez-le aux avis sur Qwen 3.8, Gemma 4 et GLM-5.3-Flash. Hy4 Preview vise davantage les agents d’entreprise à long contexte qu’un assistant local léger.
Qu'est-ce que Hy4 Preview ?

Hy4 Preview est un LLM en version preview de Tencent Hunyuan. Les pages officielles indiquent 770B paramètres totaux, environ 49B actifs par inférence et un contexte de 1M tokens. Par rapport à Hy3 Preview, autour de 295B paramètres, 21B actifs et 256K de contexte, le saut est important.
MoE signifie Mixture of Experts : le modèle contient de nombreux experts internes et n’en active qu’une partie selon l’entrée. Cela améliore l’efficacité, mais ne rend pas le modèle léger.
Utilisation en ligne, API et téléchargements

Les poids sont disponibles via Tencent-Hunyuan/Hy4-preview sur GitHub et tencent/Hy4-preview sur Hugging Face. Une version tencent/Hy4-preview-FP8 existe aussi pour réduire la pression mémoire.
Pour tester rapidement, OpenRouter est l’entrée la plus simple. Côté Tencent, regardez aussi Tencent Cloud TokenHub et Tencent Yuanbao.
Fonctions principales
Hy4 Preview est pensé pour les longues entrées et les tâches continues. Un contexte de 1M tokens peut servir à analyser des dépôts de code, contrats, rapports, documentations techniques, transcriptions et grandes bases de connaissances.
| Fonction | Intérêt |
|---|---|
| 770B MoE / 49B actifs | Grande capacité avec activation partielle |
| Contexte 1M | Documents longs, RAG, analyse de code |
| Poids ouverts | Recherche, déploiement et intégration plus faciles |
| vLLM / SGLang | Orientation serveur et entreprise |
| Écosystème Tencent | Intégrations possibles avec bureau, code et recherche |
Performances et retours

Les premiers chiffres doivent être lus avec prudence. Les benchmarks officiels donnent une direction, mais il manque encore des tests indépendants nombreux et prolongés.
Les meilleurs tests sont les tâches qui exploitent réellement l’échelle : analyse de dépôt, comparaison de documents, extraction structurée, appels d’outils et mémoire de long contexte.
Matériel local nécessaire
Le déploiement local est le principal obstacle. Même avec MoE, Hy4 Preview reste un modèle de 770B paramètres totaux. BF16 vise les serveurs multi-GPU, tandis que FP8 reste lourd pour le grand public.
| Environnement | Attente réaliste |
|---|---|
| GPU 8-24GB | Pas pratique pour le modèle complet ; privilégier API ou modèles plus petits |
| GPU unique 48GB | Encore limité ; dépendra de quantification et offload |
| Serveur multi-GPU 80GB | Option réaliste pour un déploiement sérieux |
| Cloud | Le plus simple pour tester vite |
| Frameworks | Suivre d’abord vLLM et SGLang |
Comparaison avec d'autres modèles
| Modèle | Force | Limite | Meilleur usage |
|---|---|---|---|
| Hy4 Preview | MoE massif, contexte 1M, agents | Preview et matériel lourd | Agents d’entreprise, RAG, longs documents |
| Qwen 3.8 | Bon écosystème local et multilingue | Moins extrême en contexte | LLM local, code, multilingue |
| GLM-5.3-Flash | API efficace et orientation agent | Communauté en croissance | Automatisation et produits API |
| Gemma 4 | Plus accessible localement | Pas un MoE géant 1M contexte | Assistant local équilibré |
| Llama / Mistral | Écosystème mondial mature | Pas toujours en tête sur le très long contexte récent | Déploiements locaux généraux |
NSFW et limites de sécurité
Hy4 Preview ne doit pas être considéré comme un modèle NSFW. Les produits et API officiels de Tencent devraient bloquer les contenus sexuels explicites, la violence graphique, les instructions illégales et d’autres catégories sensibles.
Des variantes uncensored communautaires peuvent arriver, mais le coût de fine-tuning d’un modèle de cette taille est élevé. Pour le roleplay adulte ou l’écriture sans filtres, des modèles plus petits spécialisés restent plus pratiques.
Points à suivre
À surveiller : benchmarks indépendants, tests de long contexte, recettes vLLM/SGLang, quantifications, latence réelle, coût API et stabilité des agents sur de longues sessions.
FAQ
Hy4 Preview est-il open source ?
Oui. GitHub et Hugging Face affichent des ressources publiques et une licence Apache-2.0.
Où le tester en ligne ?
OpenRouter est le point d’entrée le plus simple. Les utilisateurs Tencent Cloud peuvent vérifier TokenHub.
Peut-on l'utiliser sur un PC gaming ?
Pas de façon réaliste pour le modèle complet. API ou modèles plus petits seront préférables.
Est-il meilleur que Qwen 3.8 ?
Cela dépend du besoin. Hy4 Preview vise le long contexte et les agents d’entreprise ; Qwen 3.8 est plus accessible localement.
Est-il adapté au NSFW ?
Non pour les versions officielles, qui restent fortement filtrées.
Références
- Dépôt Tencent-Hunyuan/Hy4-preview
- tencent/Hy4-preview sur Hugging Face
- tencent/Hy4-preview-FP8
- OpenRouter Tencent: Hy4 preview
- Article AIbase
- Tencent Cloud TokenHub
Conclusion
Hy4 Preview est une sortie open-weight ambitieuse pour les agents et le long contexte. Sa combinaison 770B MoE, contexte 1M et poids ouverts mérite l’attention.
Mais ce n’est ni un modèle local facile, ni une option NSFW permissive. Le bon réflexe est de le tester via API, puis de le comparer à Qwen 3.8, GLM-5.3-Flash et Gemma 4 sur vos propres tâches.