Hy4 Preview Test: Tencent Hunyuan 770B MoE, 1M Kontext, API, lokale Hardware und NSFW-Grenzen

Hy4 Preview ist das neue offene Modell von Tencent Hunyuan für Long-Context-Reasoning, Code-Agenten, RAG und Unternehmens-Workflows. Die Eckdaten sind groß: 770B Gesamtparameter als MoE, etwa…

schedule
article 5 Min. Lesezeit
Hy4 Preview Test: Tencent Hunyuan 770B MoE, 1M Kontext, API, lokale Hardware und NSFW-Grenzen cover image

Hy4 Preview ist das neue offene Modell von Tencent Hunyuan für Long-Context-Reasoning, Code-Agenten, RAG und Unternehmens-Workflows. Die Eckdaten sind groß: 770B Gesamtparameter als MoE, etwa 49B aktive Parameter und ein Kontextfenster von 1M Tokens.

Praktisch sollte man nüchtern bleiben. Hy4 Preview ist spannend, aber kein leichtes lokales LLM für jeden PC. Sinnvoller ist zunächst ein API-Test über OpenRouter oder Tencent Cloud TokenHub, bevor man über eigenes Hosting nachdenkt.

Es ist auch kein NSFW- oder Uncensored-Modell. Offizielle Versionen besitzen Sicherheitsfilter, und offene Gewichte bedeuten nicht automatisch uneingeschränkte Adult-Nutzung.

Kurzfazit

Punkt Bewertung
Am besten für Lange Dokumente, Code-Agenten, RAG, Unternehmenswissen, mehrstufiges Reasoning
Typ Offenes MoE-LLM, 770B gesamt und etwa 49B aktiv
Kontext 1M Tokens
Zugang OpenRouter, Tencent Cloud TokenHub, Tencent-Produkte und Hugging Face Gewichte
Lizenz Apache-2.0 auf GitHub und Hugging Face
Achtung Preview-Version, schwer lokal zu betreiben, strenge NSFW-Filter

Zur Einordnung lohnen sich auch unsere Tests zu Qwen 3.8, Gemma 4 und GLM-5.3-Flash. Hy4 Preview zielt eher auf Enterprise-Agenten mit langem Kontext als auf einen leichten lokalen Assistenten.

Was ist Hy4 Preview?

Screenshot des offiziellen Hy4 Preview GitHub-Repositories
Das offizielle Tencent-Repository zeigt README, Lizenz und Dokumentation auf Englisch und Chinesisch.

Hy4 Preview ist ein Preview-LLM von Tencent Hunyuan. Die offiziellen Seiten nennen 770B Gesamtparameter, etwa 49B aktive Parameter pro Inferenz und 1M Tokens Kontext. Gegenüber Hy3 Preview mit rund 295B Gesamtparametern, 21B aktiven Parametern und 256K Kontext ist das ein deutlicher Sprung.

MoE steht für Mixture of Experts: Das Modell enthält viele interne Experten und aktiviert je nach Eingabe nur einen Teil davon. Das verbessert die Effizienz, macht Hy4 Preview aber nicht zu einem kleinen Modell.

Online-Nutzung, API und Downloads

Screenshot von Hy4 Preview auf Hugging Face
Die Hugging Face Seite zeigt tencent/Hy4-preview, Apache-2.0-Lizenz, Tags und Modelldateien.

Die Gewichte finden sich bei Tencent-Hunyuan/Hy4-preview auf GitHub und tencent/Hy4-preview auf Hugging Face. Für geringeren Speicherbedarf gibt es außerdem tencent/Hy4-preview-FP8.

Für einen schnellen Test ist OpenRouter der einfachste Einstieg. Im Tencent-Ökosystem sind Tencent Cloud TokenHub und Tencent Yuanbao relevant.

Wichtige Funktionen

Hy4 Preview ist für lange Eingaben und dauerhafte Aufgaben gebaut. 1M Tokens Kontext können bei Code-Repositories, Verträgen, Berichten, technischer Dokumentation, Meeting-Protokollen und großen Wissensdatenbanken helfen.

Funktion Warum sie zählt
770B MoE / 49B aktiv Große Kapazität mit Teilaktivierung pro Token
1M Kontext Nützlich für lange Dokumente, RAG und Codeanalyse
Offene Gewichte Forschung, Deployment und Integration werden einfacher
vLLM / SGLang Eher server- und enterprise-orientiert
Tencent-Ökosystem Mögliche Integration in Office-, Code- und Suchprodukte

Leistung und Praxiseindruck

Screenshot von Hy4 Preview auf OpenRouter
OpenRouter listet 1M Kontext, Anbieter, Veröffentlichungsdatum und öffentliche API-Preise.

Frühe Zahlen sollte man vorsichtig lesen. Offizielle Benchmarks helfen bei der Einordnung, ersetzen aber keine breite unabhängige Praxiserfahrung.

Sinnvolle Tests sind Aufgaben, die die Größe wirklich nutzen: Repository-Analyse, Dokumentenvergleich, strukturierte Extraktion, Tool Calls und Long-Context-Memory.

Lokale Hardware

Lokales Deployment ist die größte Hürde. Trotz MoE bleibt Hy4 Preview ein Modell mit 770B Gesamtparametern. BF16 gehört in Multi-GPU-Server, und FP8 ist für normale Heim-PCs weiterhin schwer.

Umgebung Realistische Einschätzung
8-24GB GPU Für das komplette Modell nicht praktikabel; API oder kleinere Modelle nutzen
Einzelne 48GB GPU Weiterhin eng; abhängig von Quantisierung und Offload
Mehrere 80GB GPUs Realistischer Weg für ernstes Hosting
Cloud-Inferenz Am praktischsten für schnelle Tests
Frameworks Zuerst offizielle vLLM- und SGLang-Hinweise prüfen

Vergleich mit anderen Modellen

Modell Stärke Grenze Beste Nutzung
Hy4 Preview Riesiges MoE, 1M Kontext, Agent-Fokus Preview und schwere Hardware Enterprise-Agenten, RAG, lange Dokumente
Qwen 3.8 Starkes lokales Ökosystem und Mehrsprachigkeit Weniger extrem bei Kontext/Skala Lokales LLM, Code, Mehrsprachigkeit
GLM-5.3-Flash Effiziente API und Agent-Fokus Community wächst noch Automatisierung und API-Produkte
Gemma 4 Einfacher lokal nutzbar Kein riesiges 1M-Kontext-MoE Ausgewogener lokaler Assistent
Llama / Mistral Reifes globales Tooling Nicht immer führend beim neuesten Long Context Allgemeines lokales Deployment

NSFW und Sicherheitsgrenzen

Hy4 Preview sollte nicht als NSFW-Modell betrachtet werden. Offizielle Tencent-Produkte und API-Endpunkte dürften explizite sexuelle Inhalte, grafische Gewalt, illegale Anweisungen und andere Risikokategorien filtern.

Community-Versionen ohne starke Filter könnten später erscheinen, aber Fine-Tuning in dieser Größenordnung ist teuer. Für Adult-Roleplay oder freies Schreiben sind kleinere spezialisierte Modelle derzeit praktischer.

Worauf man achten sollte

Wichtig werden unabhängige Benchmarks, Long-Context-Tests, vLLM/SGLang-Rezepte, Quantisierungen, echte Latenz, API-Kosten und Stabilität in langen Agent-Sessions.

FAQ

Ist Hy4 Preview open source?

Ja. GitHub und Hugging Face zeigen öffentliche Ressourcen und Apache-2.0-Lizenz.

Wo kann man es online testen?

OpenRouter ist der einfachste Einstieg. Tencent-Cloud-Nutzer können TokenHub prüfen.

Läuft es auf einem Gaming-PC?

Nicht realistisch für das komplette Modell. API oder kleinere Modelle sind sinnvoller.

Ist es besser als Qwen 3.8?

Das hängt vom Einsatz ab. Hy4 Preview zielt auf Long Context und Enterprise-Agenten; Qwen 3.8 ist lokal praktischer.

Eignet es sich für NSFW?

Nein, die offiziellen Versionen sind stark gefiltert.

Quellen

Fazit

Hy4 Preview ist ein ambitioniertes offenes Modell für Long Context und Enterprise-Agenten. 770B MoE, 1M Tokens und offene Gewichte sind eine starke Kombination.

Gleichzeitig ist es kein einfaches lokales Modell und keine permissive NSFW-Option. Am sinnvollsten ist ein API-Test und ein Vergleich mit Qwen 3.8, GLM-5.3-Flash und Gemma 4 auf echten eigenen Aufgaben.

Bewertungs-Tags

#1M Kontext #Hunyuan #Hy4 Preview #MoE #NSFW #Open-Source-LLM #Tencent Hunyuan

Anmelden

ODER

Konto erstellen

Passwort muss 8-20 Zeichen lang sein und Buchstaben und Zahlen enthalten

ODER

Passwort Vergessen

Passwort muss 8-20 Zeichen lang sein und Buchstaben und Zahlen enthalten