Hy4 Preview Test: Tencent Hunyuan 770B MoE, 1M Kontext, API, lokale Hardware und NSFW-Grenzen
Hy4 Preview ist das neue offene Modell von Tencent Hunyuan für Long-Context-Reasoning, Code-Agenten, RAG und Unternehmens-Workflows. Die Eckdaten sind groß: 770B Gesamtparameter als MoE, etwa…
Hy4 Preview ist das neue offene Modell von Tencent Hunyuan für Long-Context-Reasoning, Code-Agenten, RAG und Unternehmens-Workflows. Die Eckdaten sind groß: 770B Gesamtparameter als MoE, etwa 49B aktive Parameter und ein Kontextfenster von 1M Tokens.
Praktisch sollte man nüchtern bleiben. Hy4 Preview ist spannend, aber kein leichtes lokales LLM für jeden PC. Sinnvoller ist zunächst ein API-Test über OpenRouter oder Tencent Cloud TokenHub, bevor man über eigenes Hosting nachdenkt.
Es ist auch kein NSFW- oder Uncensored-Modell. Offizielle Versionen besitzen Sicherheitsfilter, und offene Gewichte bedeuten nicht automatisch uneingeschränkte Adult-Nutzung.
Inhaltsverzeichnis
Kurzfazit
| Punkt | Bewertung |
|---|---|
| Am besten für | Lange Dokumente, Code-Agenten, RAG, Unternehmenswissen, mehrstufiges Reasoning |
| Typ | Offenes MoE-LLM, 770B gesamt und etwa 49B aktiv |
| Kontext | 1M Tokens |
| Zugang | OpenRouter, Tencent Cloud TokenHub, Tencent-Produkte und Hugging Face Gewichte |
| Lizenz | Apache-2.0 auf GitHub und Hugging Face |
| Achtung | Preview-Version, schwer lokal zu betreiben, strenge NSFW-Filter |
Zur Einordnung lohnen sich auch unsere Tests zu Qwen 3.8, Gemma 4 und GLM-5.3-Flash. Hy4 Preview zielt eher auf Enterprise-Agenten mit langem Kontext als auf einen leichten lokalen Assistenten.
Was ist Hy4 Preview?

Hy4 Preview ist ein Preview-LLM von Tencent Hunyuan. Die offiziellen Seiten nennen 770B Gesamtparameter, etwa 49B aktive Parameter pro Inferenz und 1M Tokens Kontext. Gegenüber Hy3 Preview mit rund 295B Gesamtparametern, 21B aktiven Parametern und 256K Kontext ist das ein deutlicher Sprung.
MoE steht für Mixture of Experts: Das Modell enthält viele interne Experten und aktiviert je nach Eingabe nur einen Teil davon. Das verbessert die Effizienz, macht Hy4 Preview aber nicht zu einem kleinen Modell.
Online-Nutzung, API und Downloads

Die Gewichte finden sich bei Tencent-Hunyuan/Hy4-preview auf GitHub und tencent/Hy4-preview auf Hugging Face. Für geringeren Speicherbedarf gibt es außerdem tencent/Hy4-preview-FP8.
Für einen schnellen Test ist OpenRouter der einfachste Einstieg. Im Tencent-Ökosystem sind Tencent Cloud TokenHub und Tencent Yuanbao relevant.
Wichtige Funktionen
Hy4 Preview ist für lange Eingaben und dauerhafte Aufgaben gebaut. 1M Tokens Kontext können bei Code-Repositories, Verträgen, Berichten, technischer Dokumentation, Meeting-Protokollen und großen Wissensdatenbanken helfen.
| Funktion | Warum sie zählt |
|---|---|
| 770B MoE / 49B aktiv | Große Kapazität mit Teilaktivierung pro Token |
| 1M Kontext | Nützlich für lange Dokumente, RAG und Codeanalyse |
| Offene Gewichte | Forschung, Deployment und Integration werden einfacher |
| vLLM / SGLang | Eher server- und enterprise-orientiert |
| Tencent-Ökosystem | Mögliche Integration in Office-, Code- und Suchprodukte |
Leistung und Praxiseindruck

Frühe Zahlen sollte man vorsichtig lesen. Offizielle Benchmarks helfen bei der Einordnung, ersetzen aber keine breite unabhängige Praxiserfahrung.
Sinnvolle Tests sind Aufgaben, die die Größe wirklich nutzen: Repository-Analyse, Dokumentenvergleich, strukturierte Extraktion, Tool Calls und Long-Context-Memory.
Lokale Hardware
Lokales Deployment ist die größte Hürde. Trotz MoE bleibt Hy4 Preview ein Modell mit 770B Gesamtparametern. BF16 gehört in Multi-GPU-Server, und FP8 ist für normale Heim-PCs weiterhin schwer.
| Umgebung | Realistische Einschätzung |
|---|---|
| 8-24GB GPU | Für das komplette Modell nicht praktikabel; API oder kleinere Modelle nutzen |
| Einzelne 48GB GPU | Weiterhin eng; abhängig von Quantisierung und Offload |
| Mehrere 80GB GPUs | Realistischer Weg für ernstes Hosting |
| Cloud-Inferenz | Am praktischsten für schnelle Tests |
| Frameworks | Zuerst offizielle vLLM- und SGLang-Hinweise prüfen |
Vergleich mit anderen Modellen
| Modell | Stärke | Grenze | Beste Nutzung |
|---|---|---|---|
| Hy4 Preview | Riesiges MoE, 1M Kontext, Agent-Fokus | Preview und schwere Hardware | Enterprise-Agenten, RAG, lange Dokumente |
| Qwen 3.8 | Starkes lokales Ökosystem und Mehrsprachigkeit | Weniger extrem bei Kontext/Skala | Lokales LLM, Code, Mehrsprachigkeit |
| GLM-5.3-Flash | Effiziente API und Agent-Fokus | Community wächst noch | Automatisierung und API-Produkte |
| Gemma 4 | Einfacher lokal nutzbar | Kein riesiges 1M-Kontext-MoE | Ausgewogener lokaler Assistent |
| Llama / Mistral | Reifes globales Tooling | Nicht immer führend beim neuesten Long Context | Allgemeines lokales Deployment |
NSFW und Sicherheitsgrenzen
Hy4 Preview sollte nicht als NSFW-Modell betrachtet werden. Offizielle Tencent-Produkte und API-Endpunkte dürften explizite sexuelle Inhalte, grafische Gewalt, illegale Anweisungen und andere Risikokategorien filtern.
Community-Versionen ohne starke Filter könnten später erscheinen, aber Fine-Tuning in dieser Größenordnung ist teuer. Für Adult-Roleplay oder freies Schreiben sind kleinere spezialisierte Modelle derzeit praktischer.
Worauf man achten sollte
Wichtig werden unabhängige Benchmarks, Long-Context-Tests, vLLM/SGLang-Rezepte, Quantisierungen, echte Latenz, API-Kosten und Stabilität in langen Agent-Sessions.
FAQ
Ist Hy4 Preview open source?
Ja. GitHub und Hugging Face zeigen öffentliche Ressourcen und Apache-2.0-Lizenz.
Wo kann man es online testen?
OpenRouter ist der einfachste Einstieg. Tencent-Cloud-Nutzer können TokenHub prüfen.
Läuft es auf einem Gaming-PC?
Nicht realistisch für das komplette Modell. API oder kleinere Modelle sind sinnvoller.
Ist es besser als Qwen 3.8?
Das hängt vom Einsatz ab. Hy4 Preview zielt auf Long Context und Enterprise-Agenten; Qwen 3.8 ist lokal praktischer.
Eignet es sich für NSFW?
Nein, die offiziellen Versionen sind stark gefiltert.
Quellen
- Tencent-Hunyuan/Hy4-preview Repository
- tencent/Hy4-preview auf Hugging Face
- tencent/Hy4-preview-FP8
- OpenRouter Tencent: Hy4 preview
- AIbase-Bericht
- Tencent Cloud TokenHub
Fazit
Hy4 Preview ist ein ambitioniertes offenes Modell für Long Context und Enterprise-Agenten. 770B MoE, 1M Tokens und offene Gewichte sind eine starke Kombination.
Gleichzeitig ist es kein einfaches lokales Modell und keine permissive NSFW-Option. Am sinnvollsten ist ein API-Test und ein Vergleich mit Qwen 3.8, GLM-5.3-Flash und Gemma 4 auf echten eigenen Aufgaben.