Avis Hy4 Preview : Tencent Hunyuan 770B MoE, contexte 1M, API, matériel local et limites NSFW

Hy4 Preview est le nouveau modèle ouvert de Tencent Hunyuan pour le raisonnement à long contexte, les agents de code, le RAG et les workflows…

schedule
article 6 min de lecture
Avis Hy4 Preview : Tencent Hunyuan 770B MoE, contexte 1M, API, matériel local et limites NSFW cover image

Hy4 Preview est le nouveau modèle ouvert de Tencent Hunyuan pour le raisonnement à long contexte, les agents de code, le RAG et les workflows d’entreprise. Ses chiffres sont ambitieux : architecture MoE avec 770B paramètres au total, environ 49B paramètres actifs et une fenêtre de contexte de 1M tokens.

En pratique, il faut rester mesuré. Hy4 Preview est prometteur, mais ce n’est pas un petit LLM local pour PC grand public. Le plus logique est de le tester via API, avec OpenRouter ou Tencent Cloud TokenHub, avant d’envisager un déploiement privé.

Il ne faut pas non plus le présenter comme un modèle NSFW ou non censuré. Les versions officielles appliquent des garde-fous, et les poids ouverts ne signifient pas une liberté totale pour les contenus adultes.

Verdict rapide

Point Évaluation
Idéal pour Documents longs, agents de code, RAG, connaissance d’entreprise, raisonnement multi-étapes
Type LLM MoE ouvert, 770B au total et environ 49B actifs
Contexte 1M tokens
Accès OpenRouter, Tencent Cloud TokenHub, produits Tencent et poids Hugging Face
Licence Apache-2.0 sur GitHub et Hugging Face
À retenir Version preview, déploiement local lourd, filtres NSFW stricts

Pour le situer, comparez-le aux avis sur Qwen 3.8, Gemma 4 et GLM-5.3-Flash. Hy4 Preview vise davantage les agents d’entreprise à long contexte qu’un assistant local léger.

Qu'est-ce que Hy4 Preview ?

Capture du dépôt officiel Hy4 Preview sur GitHub
Le dépôt officiel Tencent affiche le README, la licence et la documentation en anglais et en chinois.

Hy4 Preview est un LLM en version preview de Tencent Hunyuan. Les pages officielles indiquent 770B paramètres totaux, environ 49B actifs par inférence et un contexte de 1M tokens. Par rapport à Hy3 Preview, autour de 295B paramètres, 21B actifs et 256K de contexte, le saut est important.

MoE signifie Mixture of Experts : le modèle contient de nombreux experts internes et n’en active qu’une partie selon l’entrée. Cela améliore l’efficacité, mais ne rend pas le modèle léger.

Utilisation en ligne, API et téléchargements

Capture de Hy4 Preview sur Hugging Face
La page Hugging Face montre tencent/Hy4-preview, la licence Apache-2.0, les tags et les fichiers du modèle.

Les poids sont disponibles via Tencent-Hunyuan/Hy4-preview sur GitHub et tencent/Hy4-preview sur Hugging Face. Une version tencent/Hy4-preview-FP8 existe aussi pour réduire la pression mémoire.

Pour tester rapidement, OpenRouter est l’entrée la plus simple. Côté Tencent, regardez aussi Tencent Cloud TokenHub et Tencent Yuanbao.

Fonctions principales

Hy4 Preview est pensé pour les longues entrées et les tâches continues. Un contexte de 1M tokens peut servir à analyser des dépôts de code, contrats, rapports, documentations techniques, transcriptions et grandes bases de connaissances.

Fonction Intérêt
770B MoE / 49B actifs Grande capacité avec activation partielle
Contexte 1M Documents longs, RAG, analyse de code
Poids ouverts Recherche, déploiement et intégration plus faciles
vLLM / SGLang Orientation serveur et entreprise
Écosystème Tencent Intégrations possibles avec bureau, code et recherche

Performances et retours

Capture de Hy4 Preview sur OpenRouter
OpenRouter liste le contexte 1M, le fournisseur, la date de sortie et les prix API publics.

Les premiers chiffres doivent être lus avec prudence. Les benchmarks officiels donnent une direction, mais il manque encore des tests indépendants nombreux et prolongés.

Les meilleurs tests sont les tâches qui exploitent réellement l’échelle : analyse de dépôt, comparaison de documents, extraction structurée, appels d’outils et mémoire de long contexte.

Matériel local nécessaire

Le déploiement local est le principal obstacle. Même avec MoE, Hy4 Preview reste un modèle de 770B paramètres totaux. BF16 vise les serveurs multi-GPU, tandis que FP8 reste lourd pour le grand public.

Environnement Attente réaliste
GPU 8-24GB Pas pratique pour le modèle complet ; privilégier API ou modèles plus petits
GPU unique 48GB Encore limité ; dépendra de quantification et offload
Serveur multi-GPU 80GB Option réaliste pour un déploiement sérieux
Cloud Le plus simple pour tester vite
Frameworks Suivre d’abord vLLM et SGLang

Comparaison avec d'autres modèles

Modèle Force Limite Meilleur usage
Hy4 Preview MoE massif, contexte 1M, agents Preview et matériel lourd Agents d’entreprise, RAG, longs documents
Qwen 3.8 Bon écosystème local et multilingue Moins extrême en contexte LLM local, code, multilingue
GLM-5.3-Flash API efficace et orientation agent Communauté en croissance Automatisation et produits API
Gemma 4 Plus accessible localement Pas un MoE géant 1M contexte Assistant local équilibré
Llama / Mistral Écosystème mondial mature Pas toujours en tête sur le très long contexte récent Déploiements locaux généraux

NSFW et limites de sécurité

Hy4 Preview ne doit pas être considéré comme un modèle NSFW. Les produits et API officiels de Tencent devraient bloquer les contenus sexuels explicites, la violence graphique, les instructions illégales et d’autres catégories sensibles.

Des variantes uncensored communautaires peuvent arriver, mais le coût de fine-tuning d’un modèle de cette taille est élevé. Pour le roleplay adulte ou l’écriture sans filtres, des modèles plus petits spécialisés restent plus pratiques.

Points à suivre

À surveiller : benchmarks indépendants, tests de long contexte, recettes vLLM/SGLang, quantifications, latence réelle, coût API et stabilité des agents sur de longues sessions.

FAQ

Hy4 Preview est-il open source ?

Oui. GitHub et Hugging Face affichent des ressources publiques et une licence Apache-2.0.

Où le tester en ligne ?

OpenRouter est le point d’entrée le plus simple. Les utilisateurs Tencent Cloud peuvent vérifier TokenHub.

Peut-on l'utiliser sur un PC gaming ?

Pas de façon réaliste pour le modèle complet. API ou modèles plus petits seront préférables.

Est-il meilleur que Qwen 3.8 ?

Cela dépend du besoin. Hy4 Preview vise le long contexte et les agents d’entreprise ; Qwen 3.8 est plus accessible localement.

Est-il adapté au NSFW ?

Non pour les versions officielles, qui restent fortement filtrées.

Références

Conclusion

Hy4 Preview est une sortie open-weight ambitieuse pour les agents et le long contexte. Sa combinaison 770B MoE, contexte 1M et poids ouverts mérite l’attention.

Mais ce n’est ni un modèle local facile, ni une option NSFW permissive. Le bon réflexe est de le tester via API, puis de le comparer à Qwen 3.8, GLM-5.3-Flash et Gemma 4 sur vos propres tâches.

Se connecter

OU

Créer un compte

Le mot de passe doit contenir entre 8 et 20 caractères et inclure des lettres et des chiffres

OU

Mot de Passe Oublié

Le mot de passe doit contenir entre 8 et 20 caractères et inclure des lettres et des chiffres