updream-视频生成助手
当前位置:首页>AI模型>Hy4 preview - 腾讯混元发布的新一代开源旗舰大语言模型

Hy4 preview - 腾讯混元发布的新一代开源旗舰大语言模型

Hy4 preview 是什么

Hy4 preview 是腾讯混元团队发布的新一代开源旗舰大语言模型,采用混合专家架构,拥有 770B 总参数和 49B 激活参数,并支持最长 1M Tokens 上下文。模型通过扩大模型规模、训练数据和后训练强度,提升长程任务规划、代码调试、跨文件分析、游戏开发和科研推理能力,适合作为复杂 AI Agent 与专业生产力应用的基础模型。

Hy4 preview 现已开源,在腾讯云 TokenHub 和 OpenRouter 上线,并可在  WorkBuddy/CodeBuddy 、元宝、ima 等产品上体验。

Hy4 preview

Hy4 preview 的主要特性

  • 大规模 MoE 架构: 模型包含78层网络、256个路由专家和1个共享专家,每个 Token 激活8个路由专家,在模型容量与推理效率之间取得平衡。
  • 1M 长上下文: 支持最长100万 Tokens 上下文,可处理大型代码库、多份文档、复杂项目资料及长时间运行的智能体任务。
  • 长程软件工程: 强化需求理解、任务规划、代码编写、调试和结果验证能力,并提升前端页面的视觉设计与交互实现质量。
  • 复杂办公分析: 能够整合分散在多个文件中的信息,完成数据分析、公式计算、金融建模,以及文档、表格和演示文稿交付。
  • 游戏开发能力: 可根据自然语言需求生成可运行的游戏原型,并通过多轮交互持续修改 Unity、Unreal Engine、Godot 等项目。
  • 科学研究能力: 面向 AI 研究、分子动力学、凝聚态物理和基础数学等任务,增强问题理解、实验组织、推理求解与结果验证能力。
  • 深度思考模式: 默认使用适合数学、编程和复杂推理任务的高强度思考模式,也可通过参数关闭深度思考,以获得更直接的回答。
  • 开放部署生态: 提供原始模型和 FP8 量化权重,支持通过 vLLM、SGLang 部署,并提供兼容 OpenAI 格式的调用接口。

Hy4 preview 的应用场景

  • 软件开发与代码智能体: 用于理解大型代码库、规划跨文件修改、排查故障、执行测试和验证开发结果。
  • 企业办公与金融分析: 整理多份合同、报表、邮件和业务资料,生成分析报告、电子表格、演示文稿及财务模型。
  • 游戏原型开发: 根据设计文档生成网页游戏或游戏引擎项目,并持续完善玩法、界面、关卡与测试流程。
  • 长文档与知识库处理: 利用1M上下文处理技术文档、研究资料、项目档案和企业知识库。
  • 科研与工程探索: 协调多轮实验、分析计算瓶颈、构建求解器,并辅助材料、物理、数学和 AI 研究。
  • 复杂智能体系统: 作为 Agent 的底层模型,执行长期规划、工具调用、多步骤操作和结果自检任务。

Hy4 preview 的产品定价

Hy4 preview 模型权重按照 Apache License 2.0 开放,下载和使用模型本身不收取授权费用,但本地部署需要自行承担服务器、GPU 和运维成本。

腾讯云 API 按 Token 用量计费,官方公布的每百万 Tokens 价格为:

计费项目价格
缓存命中输入0.3元/百万 Tokens
普通输入6元/百万 Tokens
模型输出18元/百万 Tokens

实际价格、免费额度及活动套餐可能调整,发布时建议以腾讯云 TokenHub 页面为准。

如何使用 Hy4 preview

  1. 通过腾讯产品体验: 普通用户可在腾讯元宝ima,以及 CodeBuddyWorkBuddy 等腾讯产品中体验模型能力,具体开放范围以产品端显示为准。
  2. 开通腾讯云 API: 访问 https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy4-preview,完成实名认证并创建 API Key。
  3. 调用模型接口: 在兼容 OpenAI API 的客户端或开发项目中填写腾讯云调用地址、API Key,并将模型名称设置为 hy4-preview
  4. 通过 OpenRouter 接入: 在 OpenRouter 上使用 tencent/hy4-preview,适合已接入该聚合平台的开发者。
  5. 下载开源权重
    • HuggingFace:https://huggingface.co/tencent/Hy4-preview
    • Github:https://github.com/Tencent-Hunyuan/Hy4-preview
    • Modelscope:https://modelscope.cn/models/Tencent-Hunyuan/Hy4-preview
    • Gitcode: https://ai.gitcode.com/tencent_hunyuan/Hy4-preview
  6. 部署本地服务: 按官方文档使用 vLLM 或 SGLang 启动推理服务;模型规模较大,通常需要多张高性能 GPU 进行张量并行部署。
  7. 选择思考模式: 复杂编程、数学和科研任务可保留默认深度思考模式;简单问答可使用 no_think 设置减少推理时间。

Hy4 preview 的官方资源

  • 官方介绍: https://hy.tencent.com/research/hy4-preview
  • 腾讯云 API: https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy4-preview
  • GitHub: https://github.com/Tencent-Hunyuan/Hy4-preview
  • Hugging Face: https://huggingface.co/tencent/Hy4-preview
  • ModelScope: https://modelscope.cn/models/Tencent-Hunyuan/Hy4-preview
  • OpenRouter: https://openrouter.ai/tencent/hy4-preview

常见问题

Q:Hy4 preview 是否开源?

A:是。腾讯已经开放 Hy4 preview 原始权重和 FP8 量化权重,采用 Apache License 2.0,允许开发者按照协议部署、修改和集成。

Q:普通用户可以直接使用吗?

A:可以。普通用户无需自行部署,可通过腾讯元宝、ima、CodeBuddy或WorkBuddy体验;开发者也可以通过腾讯云和OpenRouter调用API。

Q:Hy4 preview 适合处理哪些任务?

A:模型尤其适合长程软件开发、跨文件办公分析、金融建模、游戏原型开发、科学计算和需要大量上下文的智能体任务。

Q:本地部署的硬件要求高吗?

A:较高。模型拥有770B总参数,即使使用FP8量化版本,仍需要多张高性能GPU进行并行推理。个人开发者通常更适合使用云端API。

Q:Hy4 preview 目前有哪些局限?

A:这是Hy4的早期预览版本。腾讯官方指出,模型在部分复杂任务中可能思考时间过长,并存在反复验证、过度检查自身工作的倾向。

©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。 即梦AI