Hy4 Preview 評測:Tencent Hunyuan 770B MoE、1M上下文、API、本機硬體與NSFW限制

Hy4 Preview 是 Tencent Hunyuan(混元)推出的開源大型語言模型預覽版。它最吸引人的地方,是 770B 總參數的 MoE 架構...
schedule
article 5 分鐘閱讀
Hy4 Preview 評測:Tencent Hunyuan 770B MoE、1M上下文、API、本機硬體與NSFW限制 cover image

Hy4 Preview 是 Tencent Hunyuan(混元)推出的開源大型語言模型預覽版。它最吸引人的地方,是 770B 總參數的 MoE 架構、約 49B 啟用參數,以及 1M tokens 的長上下文能力。對需要處理長文件、程式碼專案、RAG、企業知識庫和多步驟 Agent 工作流的使用者來說,這是一個值得追蹤的新模型。

實際評價要稍微保守一點:Hy4 Preview 很有企圖心,但不是一般個人電腦能輕鬆跑起來的本機模型。現在比較合理的使用方式,是先透過 OpenRouter、Tencent Cloud TokenHub 或騰訊自己的產品生態測試,再決定是否需要投入本機或私有化部署。

NSFW 方面也不要把它當成無審查模型。官方 API 和產品端通常會有明顯安全限制;開源權重代表可研究、可部署、可擴展,但不代表官方版本適合成人向或不受限制的生成用途。

快速結論

項目 Hy4 Preview 評價
適合用途 長文件分析、程式碼 Agent、企業知識庫、RAG、多步驟推理
模型類型 770B 總參數、約 49B active 的 MoE 開源 LLM
上下文長度 1M tokens
使用方式 OpenRouter、Tencent Cloud TokenHub、騰訊產品、Hugging Face 權重
授權 GitHub 和 Hugging Face 顯示 Apache-2.0
主要注意點 仍是 preview,硬體門檻高,官方 NSFW 過濾較強

想理解它在目前開源 LLM 裡的位置,可以一起參考 Qwen 3.8 評測Gemma 4 評測GLM-5.3-Flash 評測。Hy4 Preview 更像企業級長上下文 Agent 模型,而不是低顯存桌面聊天模型。

Hy4 Preview 是什麼

Hy4 Preview GitHub 官方專案頁截圖
Tencent 官方 Hy4 Preview GitHub 專案頁,可看到 README、授權檔與中英文文件入口。

Hy4 Preview 是 Tencent Hunyuan 的 preview 階段大型語言模型。官方頁面顯示它採用 MoE 架構,總參數約 770B,每次推理約啟用 49B 參數,最大上下文為 1M tokens。與前代 Hy3 Preview 的 295B 總參數、約 21B 啟用參數、256K 上下文相比,規模與長文處理能力都大幅提升。

MoE 可以理解為讓模型內部有許多專家網路,根據輸入啟用其中一部分。這讓模型擁有更大的總容量,同時避免每個 token 都消耗完整 770B dense 模型的成本。不過,這並不代表它變成輕量模型,本機部署仍然是高門檻任務。

線上使用、API 與下載地址

Hy4 Preview Hugging Face 模型頁截圖
Hugging Face 的 tencent/Hy4-preview 頁面顯示模型標籤、Apache-2.0 授權與模型檔案。

模型權重可以從 Tencent-Hunyuan/Hy4-preview GitHubHugging Face tencent/Hy4-preview 查看。需要較低精度版本時,也可以關注 tencent/Hy4-preview-FP8

想直接線上測試,OpenRouter 的 Tencent: Hy4 preview 頁面最容易上手;需要騰訊雲路線則可看 Tencent Cloud TokenHub。一般使用者也可以留意 騰訊元寶 和混元相關產品的整合。

主要功能與規格

Hy4 Preview 的重點不是短問短答,而是長上下文和持續任務。1M tokens 讓它有機會處理大型程式碼庫、長篇報告、合約、論文集、會議紀錄和大量內部文件。

功能 實際意義
770B MoE / 約49B active 大模型容量與較有效率的單次推理
1M 上下文 適合長文件、RAG、程式碼庫分析和長流程 Agent
開源權重 可下載、研究、部署,不只依賴封閉 API
vLLM / SGLang 更偏向伺服器推理與企業部署
騰訊生態 可能整合辦公、程式碼、搜尋和知識庫產品

效能與實際評價

OpenRouter Hy4 Preview 頁面截圖
OpenRouter 頁面列出 1M 上下文、提供方、公開日期與 API 價格資訊。

目前早期評價需要謹慎看待。官方 benchmark 和盲測資料能說明模型定位,但還不能等同於長期第三方實測。比較明確的是,Hy4 Preview 主打程式碼、Agent、工具調用和企業生產力,而不是只拿來做一般聊天。

OpenRouter 已列出 1M 上下文與騰訊雲提供方資訊,開發者可以先用 API 測長文件、程式碼規劃、結構化抽取和工具調用。若只用短 prompt 測試,很難看出這類大型 MoE 模型真正的價值。

本機硬體需求

Hy4 Preview 最大門檻是硬體。即使 MoE 只啟用約 49B 參數,它仍是 770B 級模型。BF16 版本更接近多 GPU 伺服器場景,FP8 版本雖然降低記憶體壓力,但也不是一般 8GB、12GB 或 24GB 顯卡能輕鬆使用。

環境 現實判斷
8-24GB 顯卡 不建議嘗試完整模型,使用 API 或較小模型更實際
單張 48GB 顯卡 仍然吃力,需等待量化、offload 或專門部署方案
多張 80GB 級 GPU 較合理的本機/私有化部署方向
雲端推理 目前最適合快速測試和商業驗證
推理框架 優先參考官方 vLLM、SGLang 路線

與其他開源模型比較

模型 優點 限制 適合用途
Hy4 Preview MoE 規模大、1M 上下文、企業 Agent 定位 preview 階段,本機部署重 長文件、RAG、企業 Agent
Qwen 3.8 本機生態成熟,多語言和程式碼表現強 上下文與規模不如 Hy4 激進 個人本機 LLM、程式碼、多語言
GLM-5.3-Flash API 成本與 Agent 用途吸引人 社群仍在成長 低成本 API、工作流自動化
Gemma 4 較好上手,適合本機部署 不是超大 MoE 長上下文路線 日常助手、本機實驗
Llama / Mistral 全球社群與工具鏈成熟 長上下文與新一代中文模型方向不同 通用本機部署

NSFW 支援與安全限制

Hy4 Preview 官方版本不適合定位成 NSFW 或無審查模型。騰訊官方產品和 API 通常會對成人內容、暴力、違法行為、敏感政治、個資與高風險指令進行限制。

未來社群有可能基於開源權重做 abliterated 或 uncensored 版本,但 770B 級模型微調成本高,短期內不容易形成成熟 NSFW 生態。如果主要需求是成人向角色扮演或自由寫作,Dolphin 類模型目前更實際。

後續值得關注的地方

接下來值得關注第三方長上下文測試、程式碼 Agent 實測、vLLM/SGLang 部署案例、量化版本、API 延遲、價格變化,以及是否有更多企業場景案例。

常見問題

Hy4 Preview 是開源模型嗎?

是。官方 GitHub 和 Hugging Face 已公開模型資源,頁面顯示授權為 Apache-2.0。

哪裡可以直接試用?

OpenRouter 是最簡單的測試入口,騰訊雲使用者可查看 TokenHub

一般電腦可以跑嗎?

不建議。完整模型對硬體要求非常高,一般個人電腦更適合用 API 或較小的開源 LLM。

它比 Qwen 3.8 更值得用嗎?

用途不同。Hy4 Preview 適合長上下文與企業 Agent;Qwen 3.8 更適合個人本機和社群工具生態。

NSFW 支援好嗎?

官方版本限制較強,不建議當成 NSFW 模型使用。

參考資訊

總結

Hy4 Preview 是一個值得關注的企業級開源 LLM:770B MoE、1M 上下文、開源權重和 Agent 定位讓它在長文件與工作流場景很有潛力。

但它不是低門檻本機模型,也不是 NSFW 友善模型。最務實的做法,是先用 OpenRouter 或 Tencent Cloud 測自己的長文件、程式碼和 RAG 任務,再和 Qwen 3.8、GLM-5.3-Flash、Gemma 4 等模型比較是否值得導入。

評測標籤

#1M上下文 #Hy4 Preview #MoE #NSFW #Tencent Hunyuan #混元 #開源LLM

登入

建立帳戶

密碼必須為 8-20 位,且包含字母和數字

忘記密碼

密碼必須為 8-20 位,且包含字母和數字