月之暗面全量开源 Kimi K3:2.8 万亿参数 MoE 模型登陆 Hugging Face,国产算力 0day 适配

发布时间:2026-07-29 阅读量:38 来源: 发布人: Liv

月之暗面全量开源 Kimi K3:2.8 万亿参数 MoE 模型落地 Hugging Face,工业级长程推理有了新基座

2026 年 7 月 27 日晚,月之暗面(Moonshot AI)将旗舰大模型 Kimi K3 的完整模型权重、技术报告及配套训练基础设施(MoonEP、FlashKDA、AgentEnv)上传至 Hugging Face 开源仓库。该模型总参数 2.8 万亿、单 Token 激活约 1040 亿,采用混合专家(MoE)架构,是全球首个迈入 3 万亿参数级别的开源大模型,也是目前国内对外全量开放规模最大的基座模型之一。

在“十五五”开局、企业智能化从“对话助手”走向“研发协同”的节点上,Kimi K3 的开源意义不限于榜单刷分,更在于为工业软件、EDA 辅助编程、CAD/CAE 前处理、设备运维知识库等长上下文、高可靠场景,提供可私有部署的顶级开源选项。

1785210483171785.jpg

架构重写:从注意力机制到稀疏 MoE 的系统级创新

Kimi K3 并未沿用传统 Transformer 堆叠思路,而是在三个核心结构上做了原创性调整:

  • Kimi Delta Attention(KDA)混合线性注意力:以“3 层 KDA + 1 层 Gated MLA”的周期配置,将长序列压缩为固定大小循环状态,同时保留周期性全局检索能力,显著降低百万 Token 上下文的显存与计算膨胀;

  • Attention Residuals(注意力残差):允许当前层跨级读取前序多层特征表示,缓解深层网络信息衰减;

  • Stable LatentMoE:896 个路由专家中单 Token 仅激活 16 个,配合 SiTU-GLU 与 Quantile Balancing,在极端稀疏下维持训练稳定。官方称相比 K2 整体扩展效率提升约 2.5 倍。

1785210517363624.jpg

模型原生支持 100 万 Token 上下文与原生视觉理解(视觉-文本从预训练起联合建模,非后期对齐),适配前端生成、截图驱动调试、工业图纸多模态问答等任务。

基准表现:开源模型首次登顶前端编程榜

在公开基准中,Kimi K3 于 Frontend Code Arena 取得 1679 分,超过 Claude Fable 5(1631)与 GPT-5.6 Sol(1618),是开源模型首次在该榜单超越全部主流闭源模型;FrontierSWE 得分 81.2,BrowseComp 单次任务成本约为 GPT-5.6 Sol 的一半。

需指出的是,月之暗面技术报告也坦承:K3 综合智能仍略逊于当前最强闭源旗舰,但在长程编程、智能体协同、知识工作与视觉推理上已进入前沿区间。

部署与许可:修改版 MIT,国产算力 Day-0 适配

Kimi K3 采用修改版 MIT 许可证,开发者可下载、微调、本地私有化部署。官方推荐生产环境使用 64 张以上加速卡组成超节点集群;最小实验加载约需 8 张 80GB H100(或同级别 GPGPU)。社区已在 24 小时内推出 GGUF 量化版,适配轻量本地推理。

更关键的是国产硬件链路同步打通:华为昇腾 950 系列、Atlas A3 产品实现 0day 适配,阿里云真武 M890 超节点首日支持,vLLM Ascend / SGLang 均可加载 MXFP4 量化权重。这意味着 K3 的部署能力已不局限于英伟达生态,为国内智算中心“非 NV 路线”提供了可运行的前沿模型样本。

产业影响:模型选型从“季度采购”降维到“任务级变量”

OpenRouter 数据显示,2026 年上半年开源模型处理 Token 占比已从 1 月的 34% 升至 6 月的 65%。Kimi K3 的加入将进一步加速企业侧分化:

  • 信息抽取、日志归类等轻任务→小模型/量化模型;

  • 复杂代码库重构、跨文档推理、多模态工单处理→K3 级强模型本地或专属云运行;

  • 数据敏感场景(晶圆厂、电网调度、军工配套)→全私有化权重部署,杜绝外传。

对工业客户而言,“前沿智能属于所有人”的落地形态,是把过去只有云服务巨头能调用的能力,变成可嵌入 PLM、MES、EDA 流程的本地组件。

下一步:从 K2 到 K3,月之暗面把开源做成主线

月之暗面自 K2 起明确开源路线,K3 将模型本体、训练 Infra、技术论文全链条开放。公司 2026 年 6 月年化经常性收入约 3 亿美元,计划 8 月启动 Pre-IPO 轮,目标投前估值 500 亿美元,香港上市节奏提速;但相较资本动作,其对产业侧更直接的影响是——中国大模型公司开始用自研架构 + 全量开源 + 国产算力适配的组合,参与全球基座模型规则制定。


相关资讯
英飞凌重构在华战略:以系统级创新打通数字化与电气化“任督二脉”

2026年,随着“十五五”规划进入实施阶段,中国制造业正由规模扩张转向以“新质生产力”为核心的深度结构调整。智能网联新能源汽车加速普及,具身智能与低空经济从概念走向量产,算力基础设施在AI大模型驱动下持续扩容——这些高成长性赛道在拉动产业链升级的同时,也对底层半导体提出了更高维度的要求:不仅要在极端工况下保持稳定与可靠,更需在能效比、功率密度与系统集成度上实现跨越式突破。近日,英飞凌在上海张江举行媒体日,围绕功率系统与物联网两大基石,系统展示了其在中国市场的战略布局与技术路线图,清晰回应了数字化、电气化与低碳化三重浪潮下,半导体产业所面临的现实挑战与长期机遇。

纳祥科技 NX20 同步降压转换器量产,国产 PMU 再添高效新选择

纳祥科技推出高效同步降压转换器 NX20,国产电源管理芯片再添高性价比方案 在消费电子与智能硬件持续向小型化、低功耗方向演进的背景下,电源管理芯片作为系统稳定运行的“心脏”,其转换效率、集成度与可靠性直接影响终端产品的竞争力。近日,纳祥科技正式推出一款面向中高端应用的高性能同步降压转换器——NX20。该芯片凭借宽电压输入、高效率转换与完善的保护机制,为平板显示、网络通信、音频设备等多元场景提供紧凑且可靠的电源解决方案。

AI 与能源双重博弈:美国封禁中国机器人新品,全球供应链面临重构

北京时间 2026 年 7 月 29 日,据路透社等外媒报道,美国联邦通信委员会(FCC)于当地时间周二发布一项即刻生效的管制新规,禁止部分新型中国产联网设备进入美国市场。本次受管制产品明确指向两大类别:搭载 AI 能力的新型人形机器人、四足机器狗,以及具备联网功能的电力逆变器。这也是继芯片、半导体设备及无人机之后,美国对华科技管制首次系统性覆盖智能机器人与新能源电力电子赛道。

从芯片到在轨验证:“紫丁香三号”打通微纳卫星科创闭环

7月22日10时54分,由哈尔滨工业大学紫丁香学生微纳卫星团队研制的“紫丁香三号”卫星,搭乘“引力一号”遥四运载火箭顺利升空,准确进入预定轨道。作为国内罕见的超扁平盘式微纳卫星,该星在半导体高密集成、嵌入式系统优化及智能姿轨控制等方面取得多项突破,展现出青年科研力量在航天电子领域的实战能力。

NVIDIA PhysicsNeMo 重构上线:AI 物理模型正式进入工程智能体工作流

NVIDIA 近日宣布全面升级面向工程领域的 NVIDIA Agent Toolkit,正式将架构重构后的 NVIDIA PhysicsNeMo™ 库以及一系列更新的 NVIDIA CUDA‑X™ 库纳入其中。此举旨在为软件开发者提供构建具备物理推理能力、加速求解能力与量子化学仿真能力的“自主 AI 工程师”,以重塑芯片、系统与工业产品的设计与验证流程。