Hy4 preview 是什么
Hy4 preview 是腾讯混元团队发布的新一代开源旗舰大语言模型,采用混合专家架构,拥有 770B 总参数和 49B 激活参数,并支持最长 1M Tokens 上下文。模型通过扩大模型规模、训练数据和后训练强度,提升长程任务规划、代码调试、跨文件分析、游戏开发和科研推理能力,适合作为复杂 AI Agent 与专业生产力应用的基础模型。
Hy4 preview 现已开源,在腾讯云 TokenHub 和 OpenRouter 上线,并可在 WorkBuddy/CodeBuddy 、元宝、ima 等产品上体验。

Hy4 preview 的主要特性
- 大规模 MoE 架构: 模型包含78层网络、256个路由专家和1个共享专家,每个 Token 激活8个路由专家,在模型容量与推理效率之间取得平衡。
- 1M 长上下文: 支持最长100万 Tokens 上下文,可处理大型代码库、多份文档、复杂项目资料及长时间运行的智能体任务。
- 长程软件工程: 强化需求理解、任务规划、代码编写、调试和结果验证能力,并提升前端页面的视觉设计与交互实现质量。
- 复杂办公分析: 能够整合分散在多个文件中的信息,完成数据分析、公式计算、金融建模,以及文档、表格和演示文稿交付。
- 游戏开发能力: 可根据自然语言需求生成可运行的游戏原型,并通过多轮交互持续修改 Unity、Unreal Engine、Godot 等项目。
- 科学研究能力: 面向 AI 研究、分子动力学、凝聚态物理和基础数学等任务,增强问题理解、实验组织、推理求解与结果验证能力。
- 深度思考模式: 默认使用适合数学、编程和复杂推理任务的高强度思考模式,也可通过参数关闭深度思考,以获得更直接的回答。
- 开放部署生态: 提供原始模型和 FP8 量化权重,支持通过 vLLM、SGLang 部署,并提供兼容 OpenAI 格式的调用接口。
Hy4 preview 的应用场景
- 软件开发与代码智能体: 用于理解大型代码库、规划跨文件修改、排查故障、执行测试和验证开发结果。
- 企业办公与金融分析: 整理多份合同、报表、邮件和业务资料,生成分析报告、电子表格、演示文稿及财务模型。
- 游戏原型开发: 根据设计文档生成网页游戏或游戏引擎项目,并持续完善玩法、界面、关卡与测试流程。
- 长文档与知识库处理: 利用1M上下文处理技术文档、研究资料、项目档案和企业知识库。
- 科研与工程探索: 协调多轮实验、分析计算瓶颈、构建求解器,并辅助材料、物理、数学和 AI 研究。
- 复杂智能体系统: 作为 Agent 的底层模型,执行长期规划、工具调用、多步骤操作和结果自检任务。
Hy4 preview 的产品定价
Hy4 preview 模型权重按照 Apache License 2.0 开放,下载和使用模型本身不收取授权费用,但本地部署需要自行承担服务器、GPU 和运维成本。
腾讯云 API 按 Token 用量计费,官方公布的每百万 Tokens 价格为:
| 计费项目 | 价格 |
|---|---|
| 缓存命中输入 | 0.3元/百万 Tokens |
| 普通输入 | 6元/百万 Tokens |
| 模型输出 | 18元/百万 Tokens |
实际价格、免费额度及活动套餐可能调整,发布时建议以腾讯云 TokenHub 页面为准。
如何使用 Hy4 preview
- 通过腾讯产品体验: 普通用户可在腾讯元宝、ima,以及 CodeBuddy、WorkBuddy 等腾讯产品中体验模型能力,具体开放范围以产品端显示为准。
- 开通腾讯云 API: 访问 https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy4-preview,完成实名认证并创建 API Key。
- 调用模型接口: 在兼容 OpenAI API 的客户端或开发项目中填写腾讯云调用地址、API Key,并将模型名称设置为
hy4-preview。 - 通过 OpenRouter 接入: 在 OpenRouter 上使用
tencent/hy4-preview,适合已接入该聚合平台的开发者。 - 下载开源权重:
- HuggingFace:https://huggingface.co/tencent/Hy4-preview
- Github:https://github.com/Tencent-Hunyuan/Hy4-preview
- Modelscope:https://modelscope.cn/models/Tencent-Hunyuan/Hy4-preview
- Gitcode: https://ai.gitcode.com/tencent_hunyuan/Hy4-preview
- 部署本地服务: 按官方文档使用 vLLM 或 SGLang 启动推理服务;模型规模较大,通常需要多张高性能 GPU 进行张量并行部署。
- 选择思考模式: 复杂编程、数学和科研任务可保留默认深度思考模式;简单问答可使用
no_think设置减少推理时间。
Hy4 preview 的官方资源
- 官方介绍: https://hy.tencent.com/research/hy4-preview
- 腾讯云 API: https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy4-preview
- GitHub: https://github.com/Tencent-Hunyuan/Hy4-preview
- Hugging Face: https://huggingface.co/tencent/Hy4-preview
- ModelScope: https://modelscope.cn/models/Tencent-Hunyuan/Hy4-preview
- OpenRouter: https://openrouter.ai/tencent/hy4-preview
常见问题
Q:Hy4 preview 是否开源?
A:是。腾讯已经开放 Hy4 preview 原始权重和 FP8 量化权重,采用 Apache License 2.0,允许开发者按照协议部署、修改和集成。
Q:普通用户可以直接使用吗?
A:可以。普通用户无需自行部署,可通过腾讯元宝、ima、CodeBuddy或WorkBuddy体验;开发者也可以通过腾讯云和OpenRouter调用API。
Q:Hy4 preview 适合处理哪些任务?
A:模型尤其适合长程软件开发、跨文件办公分析、金融建模、游戏原型开发、科学计算和需要大量上下文的智能体任务。
Q:本地部署的硬件要求高吗?
A:较高。模型拥有770B总参数,即使使用FP8量化版本,仍需要多张高性能GPU进行并行推理。个人开发者通常更适合使用云端API。
Q:Hy4 preview 目前有哪些局限?
A:这是Hy4的早期预览版本。腾讯官方指出,模型在部分复杂任务中可能思考时间过长,并存在反复验证、过度检查自身工作的倾向。


