腾讯发布Hy3预览版 7700亿参数开源模型瞄准软件工程与金融分析

据 ai987.cn 于 2026 年 9 月 1 日收到的消息 ‣ 腾讯控股(港交所:0700)于 2026 年 8 月 28 日发布了新一代开源 AI 模型 Hy3 的预览版,标志着该公司在开源大模型领域的最新布局。据路透社报道,此次发布的模型采用混合专家架构,总参数量约 7700 亿,每次请求激活参数约 490 亿,模型权重已在 Hugging Face 平台的 tencent/Hy3 仓库开放,同时提供了面向内存受限场景的 Hy3-FP8 量化版本。

腾讯发布Hy3预览版 7700亿参数开源模型瞄准软件工程与金融分析 - Image 1

新模型延续了腾讯此前在 Hunyuan 与 Hy3 系列上的技术路线。混合专家架构通过将请求路由至专门的子网络,在保持庞大知识库的同时大幅降低推理成本。这一参数规模使其接近智谱 AI 的 GLM-5.2(约 7530 亿总参数),并显著超越腾讯自身于 2026 年 7 月 6 日发布的完整版 Hy3(总参数 2950 亿、激活参数 210 亿)。据日本科技媒体 GIGAZINE 报道,7 月版本在 FrontierScience-Olympiad 等科研推理基准上表现优于 GPT-5.5,且文档处理令牌消耗比 GLM-5.2 低 47.4%。

路透社披露的一个关键细节是,腾讯计划将新模型直接集成到其面向企业的编程助手 CodeBuddy 与办公协作工具 WorkBuddy 中。这种“开源权重+商业化产品”的双轨策略,使开发者可免费下载自部署或微调,而企业客户则可通过订阅获得托管与支持服务。此前 7 月版发布时,腾讯曾通过 OpenRouter 提供两周免费 API 调用,随后转为计费模式,显示出类似的市场推广节奏。

许可方面,7 月完整版采用 Apache 2.0 协议,无领域与地域限制,这推动了第三方推理平台的快速接入。路透社未披露 8 月预览版的具体许可条款,开发者在商用前需核对 Hugging Face 仓库附带的许可文件。模型权重亦同步镜像至 ModelScope、GitCode、CNB 等国内平台,延续了腾讯多渠道分发的惯例。

从竞争格局看,中国开源大模型阵营已形成腾讯 Hy3、深度求索 DeepSeek-V4-Pro(约 1.6 万亿参数)、智谱 GLM-5.2、阿里巴巴 Qwen3.8-Max 并立的局面。腾讯的差异化在于将开源模型与自有商业软件深度绑定,而非单纯追求榜单排名。分析人士认为,这一策略有助于构建更持久的收入来源。

对于工程团队而言,7700 亿参数的 MoE 模型通常需要多 GPU 推理集群或托管 API 支持。已部署 7 月版的团队可先通过 FP8 量化版评估性能提升。鉴于预览版尚缺第三方独立基准测试,建议将性能宣称视为暂时性指标,待 SWE-bench、HumanEval 等公开评测结果出炉后再做决策。

展望后续,腾讯或将在数周内发布正式版基准数据,CodeBuddy 与 WorkBuddy 预计本季度推出相关功能更新,竞争对手大概率跟进发布更大规模模型,第三方推理服务商也将迅速上线托管服务。Hy3 系列版本边界的命名模糊性,有待腾讯发布技术报告或模型卡片澄清。

回顾发展脉络,从 2024 年 10 月 Hunyuan-Large(3890 亿参数)被誉为当时最大开源 MoE 模型,到不到两年后参数规模跃升至万亿量级,反映出中国 AI 实验室在算力受限背景下,通过架构创新与开源分发实现快速迭代的共同路径。

综合自网络信息


吉ICP备2020006555号

ai987.cn

⌜ 免 责 声 明 ⌝
本站仅为个人学习AI(人工智能)知识的相关日志,网页内容(如有图片或视频亦包括在内)短期缓存均无商业目的。
遇有侵害您合法权益之处欲申诉删改,可联络处理(删/改)!