READING科创视野新闻网
科创视野新闻网 · 资料整理

腾讯发布混元 Hy4 preview 模型,参数规模与应用能力公布

腾讯发布了混元 Hy4 preview 模型,该模型总参数达到 770 B,激活参数为 49 B,上下文长度支持 1M。根据公开资料,Hy4 preview 可在 HuggingFace、Github、Modelscope 和 Gitcode 等平台获取。此外,配合 Hyra,腾讯利用混元 Hy4 preview 在三维 Blaschke–Lebesgue 问题上取得了突破性进展。

科创视野新闻网 · 资料整理

当前大型语言模型领域正处于快速迭代期,开源模型的性能和参数规模成为业界关注的焦点。在这一背景下,腾讯发布了混元 Hy4 preview 模型,旨在稳居开源模型的第一梯队。

根据公开资料,腾讯发布的混元 Hy4 preview 模型具有显著的技术指标:该模型总参数为 770 B,激活参数为 49 B,并且上下文长度达到了 1M。这些参数配置和超长的上下文窗口是衡量当前前沿大模型的关键技术指标。

除了基础的模型能力展示外,腾讯还公布了混元 Hy4 preview 模型在特定科学问题上的应用成果。具体而言,配合 Hyra,混元 Hy4 preview 在三维 Blaschke–Lebesgue 问题上取得了重大突破,成功将体积下界从原先的 0.380799推进至 0.41104。

关于模型的获取渠道,根据公开资料显示,腾讯已将混元 Hy4 preview 模型部署在多个主流平台,用户可以在 HuggingFace、Github、Modelscope 和 Gitcode 等平台上获取该模型进行研究和使用。

从技术细节来看,总参数量达到 770 B的规模,结合激活参数为 49 B的设计,体现了模型在效率与性能之间的平衡考量。上下文长度支持 1M意味着混元 Hy4 preview 模型能够处理极长篇幅的输入信息,这对于需要分析长文档、代码库或复杂对话历史的应用场景具有重要意义。

本次发布展示的模型能力,尤其是在解决如三维 Blaschke–Lebesgue 问题这类高难度数学问题上的突破,表明腾讯正在推动模型从通用文本生成向更深层次的科学推理和具身智能方向发展。这标志着混元系列模型在垂直领域应用能力的增强。

影响分析方面,开源社区对参数规模、上下文长度以及特定任务的解决能力高度敏感。混元 Hy4 preview 模型在多个平台同步开放,极大地降低了研究门槛,预计将激发更多开发者和科研人员基于此模型进行二次开发和创新尝试。

时间线回顾显示,腾讯发布混元 Hy4 preview 模型这一事件,是其持续投入于基础大模型能力建设的最新里程碑。此前已积累的模型经验为本次参数规模和应用场景的拓展奠定了坚实的基础。

读者提示:对于关注开源AI进展的用户而言,应重点关注混元 Hy4 preview 模型在不同任务上的实际推理表现,而不仅仅是其公布的参数指标。由于信息来源于单一公开资料,用户在使用时需结合模型官方文档进行更深入的学习和验证。

信息来源

本文基于上述公开资料整理,未使用来源页面的图片、视频或嵌入媒体。