据 ai987.cn 于 2026 年 7 月 30 日收到的消息 ‣ 中国人工智能初创公司月之暗面正式发布 Kimi K3 的完整开放权重,这标志着全球最大规模的开放权重 AI 模型正式面向公众开放。该模型拥有 2.8 万亿参数,于 7 月 27 日零点 UTC 时间通过 Hugging Face 平台发布,开发者可下载完整模型权重。采用 MXFP4 量化存储,下载体积约 1.4 TB,属于有史以来最大规模的 AI 模型公开分发之一。

月之暗面在社交平台 X 上宣布:“发布 Kimi K3 模型权重与技术报告。Kimi K3 是我们最强模型:2.8T MoE 架构,原生视觉理解,100 万 token 上下文窗口。新架构实现单位算力智能提升 2.5 倍,而非单纯堆砌参数。”公司同时开放了支撑模型运行的高性能注意力内核、MoE 通信库及大规模智能体环境基础设施。
Kimi K3 采用混合专家架构,包含 896 个专家,推理时每 token 仅激活 16 个专家,大幅降低计算开销。其 100 万 token 上下文窗口支持单次处理整个软件仓库、长篇技术文档、法律记录或研究论文。月之暗面推出两个版本:K3 Max 侧重通用对话、推理、编程与自主智能体任务;K3 Swarm Max 面向多智能体编排,支持多个 AI 智能体协作完成大型软件工程与研究项目。
基准测试显示,Kimi K3 在发布数小时内登顶 Arena.ai 前端代码竞技场,超越 Anthropic 的 Claude Fable 5。Artificial Analysis 评测显示,Kimi K3 在 AA-Briefcase 基准(智能体知识工作测试)中位列第二,Elo 得分 1543,仅次于 Claude Fable 5,领先 GPT-5.6 Sol、Claude Sonnet 5 与 Claude Opus 4.8。其评分通过率 51%,分析推理能力处于领先梯队,但呈现质量仍落后于部分竞品。
不过,高性能伴随高成本。Artificial Analysis 估算 Kimi K3 单基准任务平均成本 10.57 美元,约为上一代 Kimi K2.6 的十倍;平均任务耗时 56 分钟,受长对话、大输出量及 API 推理速度影响,属于运行成本最高的前沿模型之一。本地部署通常需 8 块 Nvidia H100 GPU 或超 2 TB 显存,超出大多数个人开发者承受范围。
此次开放权重发布意义超越榜单排名。开发者可在自有基础设施上审查、修改、微调并部署模型,不再完全依赖商业 API。企业可针对专有数据定制,研究机构可深入研究模型行为,初创公司获得另一高性能闭源替代方案。当前开源与专有 AI 之争愈演愈烈,OpenAI 与 Anthropic 等美企仍保持前沿模型闭源,以安全风险为由;中国 AI 企业则加速开放权重发布,推动研究社区与企业开发者广泛采用。过去一年,DeepSeek、阿里巴巴、Z.ai、MiniMax 与月之暗面等中国公司在推理、编程与智能体任务上持续缩小与美企顶尖模型的差距。Kimi K3 的发布标志着竞争焦点已从单纯基准分数,转向谁能将最强 AI 系统直接交到开发者手中。
对于软件团队、研究人员与 AI 产品构建者而言,免费获取 2.8 万亿参数模型在一年前几乎难以想象。全球最大开放权重 AI 模型不再局限于单一公司服务器,具备足够算力基础设施的任何人都可将其投入使用。
综合自网络信息