Kimi K3正式开源!2.8万亿参数砸向全球,华盛顿被逼到墙角
7月27日,月之暗面(Moonshot AI)将 Kimi K3 的完整模型权重上传至 Hugging Face,技术报告同步发布于 GitHub,随附一份名为 Kimi K3 License 的定制许可证。这是全球首个进入3万亿参数级别的开放权重模型——总参数2.8万亿、激活1040亿、100万token上下文。距离7月16日 K3 以托管服务首发,整整11天。 11天里,独立评测机构给出它全球第三的智能指数,仅次于 Claude Fable 5 与 GPT-5.6 Sol;Z.ai 港股盘中跌30%、MiniMax 跌16%;Moonshot 日收入增长至少6倍,估值锚从200亿美元抬向500亿美元;白宫科技政策办公室主任公开指控其蒸馏 Anthropic 技术,财政部长放话制裁,而英伟达、微软、Meta 等25家美国公司联名上书,反对封杀开源模型——OpenAI、Anthropic、Google 三家均不在首批名单上。 美国媒体对这件事的政治报道密度,已经超过技术报道本身。 从“宣称开源”到“文件落地” 7月16日到7月26日之间,K3 在英文社区一直是一个“戴着开源新闻稿的 API 模型”——Hugging Face 仓库返回404,开发者搜到的全是 K2.7 Code。Moonshot 官方文档承诺的是“7月27日前发布全量权重”,多家海外技术媒体连续十天挂着倒计时页面。 今天权重落地,才算把承诺兑现。而这一天,恰好是华盛顿关于“要不要封杀中国开源模型”的争论最白热化的时刻。 核心参数(据官方模型卡与技术报告): 总参数 / 激活参数:2.8万亿 / 1040亿 架构:MoE,896个专家,每token激活16个 上下文窗口:100万token 多模态:原生视觉理解,视觉编码器 MoonViT-V2 注意力机制:Kimi Delta Attention(KDA)覆盖93层中的69层,另有24层门控隐注意力 关键创新:Attention Residuals、Stable LatentMoE 效率:官方称相比 K2 实现约2.5倍的扩展效率提升 Moonshot 称其为“全球首个3万亿参数级别的开放模型”。 许可证是今天最被低估的信息 真正的新变量不是权重本身,而是随权重一起发布的 Kimi K3 License——一份“看起来像 MIT,但在营收线以上另有条款”的定制协议。 Unite.AI 逐条解读后指出,协议主体部分与 MIT 无异:任何人可免费使用、复制、修改、分发、再许可与销售,可部署、微调、构建衍生模型。但有两条附加义务。 第一,模型即服务(MaaS)条款。若被许可方向第三方提供推理或微调访问、且第三方对输入、参数或训练数据有实质控制权,当该主体及其关联方在任意连续12个月内收入超过2000万美元,须与 Moonshot 另签协议。 第二,署名条款。月活超过1亿、或月收入超过2000万美元的商业产品,须在界面显著位置标注“Kimi K3”。 纯内部使用、通过 Moonshot 自有产品或其认证推理伙伴访问的,均不受约束。将模型嵌入某个具体功能、或仅做请求转发的产品,也不落入“服务”定义。 这份协议的实际效果,是按商业模式而非按用户切分。一个在自有基础设施上微调 K3 的团队,零义务;一个大规模转售 K3 推理的云厂商,必须先拿合同。这是中国头部模型公司第一次在开源许可里,把“云厂商搭便车”这件事写成了明码标价的商业条款。 第三名含金量大幅上升 独立评测机构 Artificial Analysis 在 K3 仅有 API 时给出 Intelligence Index 57分,全球第三,与 Claude Opus 4.8、GPT-5.5 同档,落后于 Anthropic 的 Claude Fable 5 和 OpenAI 的 GPT-5.6 Sol。 真正刺眼的是它甩开其他开源模型的幅度:GLM-5.2 为51分,DeepSeek V4 Pro 为44分。 智能体(agentic)维度更强。GDPval-AA v2 拿到1668 Elo,K2.6 仅1190;AutomationBench-AA 以53%位列全球第一;单任务成本0.94美元,接近 GPT-5.6 Sol,约为 Opus 4.8 的一半。 前端编码是最出圈的一战。Arena 的 Frontend Code Arena 采用人类盲测投票机制,K3 上线当日拿到1679分登顶,在7个前端细分领域中的6个领先——相比 K2.6 的第18名,跃升17位。 Moonshot 官方基准报 GPQA Diamond 93.5%、BrowseComp 91.2,但脚注坦承不同模型使用了不同的 agent harness。官方发布文亦自陈整体性能仍落后于 Fable 5 与 GPT-5.6 Sol,并点名用户体验存在差距。 权重开放的意义正在于此:从今天起,这些数字任何人都能自己跑一遍,不必再接受厂商 harness 下的结论。 价格:把闭源溢价的逻辑撕开一道口子 K3 官方 API 定价为每百万token输入3美元、缓存输入0.3美元、输出15美元,全上下文窗口统一定价。作为对照,Claude Fable 5 为10美元和50美元。The Week 援引《金融时报》称,K3 运行成本约为 Opus 4.8 的三分之一;Axios 的口径是便宜约40%。 但有两个反向变量必须说清楚, 其一,K3 很“费token”。多位实测者反馈,完成同一任务它比 Fable 消耗更多token,叠加默认全开的 max reasoning 推理模式与15美元的输出单价,单任务实际成本可能高于逐token对比所显示的水平。 其二,自托管不是省钱按钮。Moonshot 建议在64个及以上加速器的超节点上部署,支持 vLLM、SGLang、TokenSpeed。因为 KDA 破坏了常规前缀缓存,Moonshot 专门给 vLLM 项目贡献了自研缓存实现。技术报告还提到一个容易踩的坑:K3 以“保留思维历史”(preserved thinking history)模式训练,harness 必须把完整的前序 assistant 消息连同推理内容与工具调用一并回传,中途丢弃或从别的模型切换过来,输出会不稳定。 一句话:这是一个 Hugging Face 加集群加法务的三重事件,不是一个“下载即用”的 App。 资本市场:先杀同行,再杀估值锚 K3 首发那周,港股与中概 AI 板块出现了教科书式的同业绞杀:Z.ai 港股盘中一度跌30%,MiniMax 一度跌16%,阿里巴巴跌4%。美股方面,多家媒体提到芯片股受到波及。 而 Moonshot 自身的财务曲线陡峭得罕见。K3 发布后,日收入至少增长6倍(彭博);6月ARR达3亿美元,4月还是2亿美元;5月刚以200亿美元估值完成20亿美元融资,由美团旗下龙珠投资领投;目前正在以500亿美元估值寻求新一轮融资,并筹备最快年内的港股IPO。 两个月,估值锚从200亿抬到500亿。K3 就是那张定价单。 华盛顿:从“如何应对”变成“内讧” 指控层面。白宫科技政策办公室主任 Michael Kratsios 公开指控 Moonshot 通过蒸馏 Anthropic 的 Fable 5 技术开发 K3。他区分了两种情形:正当的 AI 蒸馏在开放创新生态中有重要作用,但“以窃取美国专有技术为目的的大规模、隐蔽的工业级蒸馏”不可接受。财政部长 Scott Bessent 随后向 CNBC 表示,政府将调查中国公司是否窃取美国知识产权,并称“我们有能力因此对其实施制裁”。白宫官员与 Anthropic 将其定性为“IP盗窃”与“产业间谍”。中方否认相关指控,称其毫无根据。 政策工具箱。据 Axios 报道,商务部去年曾考虑将多家中国 AI 实验室列入实体清单,NSA 与国家网络总监办公室曾权衡发布劝阻美企使用中国 AI 的建议,白宫曾考虑一项行政令——只有能保证安全并承担泄露责任的美国公司才可托管中国模型。这些措施当时均未落地。K3 让它们全部重新变成可选项。 内讧层面。Fast Company 的观察最尖锐:K3 让美国前沿实验室看似舒适的领先优势瞬间收窄,而华盛顿与硅谷的第一反应是彼此开火。 OpenAI 战略未来主管、前白宫 AI 顾问 Dean Ball 称中国的开源路线是“彻底的AI共产主义”,并预判特朗普政府最终会意识到“最佳策略是围绕中国开源模型的使用制造大量监管风险”。值得注意的是,他同时承认 K3“是个非常好的模型”,其性能无法用蒸馏来解释。 前白宫 AI 与加密事务负责人 David Sacks 公开反驳:“对 Kimi 的恐慌必须停止,领先的美国模型仍然更强。” 美国创新基金会 AI 政策主任 Samuel Hammond 说,华盛顿此前一直假设中国落后前沿数月,“美国情报界的职责之一,就是不被意外”。 MATS 项目研究员 Kristy Loke 表示,接近华盛顿的人士“确实有强烈兴趣禁掉这些模型”,但她提醒:绝大多数美国公司不是 OpenAI 或 Anthropic,“大多数公司乐于拥有开源模型这个选项”,封禁会保护前沿实验室的收入,却抬高美国企业与初创公司的成本。 产业界的反击。7月24日,25家美国科技与投资机构联署公开信《Open Weights and American AI Leadership》,签署方包括英伟达、微软、Meta、IBM、戴尔、Palantir、a16z、Hugging Face、Y Combinator、Mozilla、Mistral、Replit、Perplexity、Linux基金会等。信中主张:仅依赖闭源模型本身并不天然安全,它们同样可能被攻破、被滥用,或以外部无法察觉的方式失效;对非法蒸馏的关切应通过“有针对性的法律与商业框架”解决,而非“对创新中扮演重要角色的技术手段施加全面限制”。英伟达CEO黄仁勋用他在X上的首条帖子推广这封信,数小时内浏览量超过1100万。 谁没签,比谁签了更说明问题:OpenAI、Anthropic、Google 均未在首批名单上。这三家恰恰是华盛顿封禁中国开源模型的最大受益方。Anthropic 未签署且未就此信给出具体理由,其一贯立场是:公开发布强大模型权重会带来安全风险,因为访问权一旦释出便难以撤回。另据 MLQ 报道,该联署后续扩容至约50家,Google、OpenAI、微软、Meta、AMD 等在列——此为后续动态,与首批名单存在口径差异,引用时需注明时点。 一个对冲性数据。据 Arabiya Business 援引的英美联合评估,K3 的网络安全能力得分为32.2%,而领先美国模型的平均分为76.2%,“远低于”后者。但 BigGo 的报道又提到,K3 在27分钟内于一台 Reddit 服务器上发现零日漏洞的表现,同时让开发者和国安官员为之震动。两组信息并不完全冲突,但足以说明:关于 K3 到底构成多大安全风险,美方内部并没有共识。 最要命的是,任何人下载就能用 AI Weekly 的总结点破了整件事的死结:本周 Kimi 头条底下的信号是政策,不是排行榜。 而政策面临一个物理上无法回避的事实——一旦权重上了互联网,它就在互联网上了。 更微妙的是同期发生的另一件事。据 The Hill 转引的报道,联邦官员此前曾要求 Anthropic 在亚马逊提出网络安全担忧后,将其最新 Claude 模型全球下架两周有余。一边是美国监管对本土实验室的强度前所未有,一边是任何人只要有服务器就能下载运行 K3、全程不经过任何美国云。这构成了2026年AI治理最尴尬的一组对照。 另一个正在改变力量对比的数据:据 byteiota 引述 OpenRouter 数据,中国开源模型目前已占该多模型API网关路由token用量的46.4%,美国模型为35.7%。这是“封禁在技术上是否还来得及”这一问题的量化答案。 后市观察 对国内投资者与产业观察者,接下来30天有四个可验证的观测点。 第一,实体清单。Moonshot 是否被列入。一旦落地,直接构成美国企业的采购合规风险,也会重定价其港股IPO的估值区间。 第二,行政令。白宫是否签署针对开源模型或中国模型输出责任的行政命令。截至7月25日,尚无行政令或立法通过,自托管 Kimi K3、Llama、Mistral、GLM 目前不受任何现行法律限制。 第三,推理服务价格战。权重落地当日即是发令枪,所有推理服务商将在同一份权重上,围绕价格、延迟、量化质量与可靠性竞争。“同模型、不同服务”第一次成为真实的采购决策变量。这对英伟达是需求增量,对闭源API是价格压力。 第四,社区复现。技术报告已公开,KDA、Attention Residuals、Stable LatentMoE 能否被独立验证,将决定“蒸馏说”的成色。这既是技术问题,也已经是地缘政治问题。 最后提示一个容易被中文舆论场忽略的定义问题。K3 是 open-weight(开放权重),不是 open-source(开源)。你拿到的是权重、许可证和技术报告,训练数据与完整训练代码仍属 Moonshot 私有。英文技术社区对这条线划得极清楚,中文报道混用会直接影响可信度。 资料 Company、Quartz、VentureBeat、Tom‘s Hardware、The Week(转引FT、CNN、Telegraph)、Unite.AI、TechNode、Silicon Republic、Artificial Analysis、Moonshot AI 官方模型卡与技术报告。截稿时间:2026年7月27日。