7月27日,月之暗面(MoonshotAI)将KimiK3的完整模型权重上传至HuggingFace,技术报告同步发布于GitHub,随附一份名为KimiK3License的定制许可证。这是全球首个进入3万亿参数级别的开放权重模型——总参数2.8万亿、激活1040亿、100万token上下文。距离7月16日K3以托管服务首发,整整11天。
11天里,独立评测机构给出它全球第三的智能指数,仅次于ClaudeFable5与GPT-5.6Sol;Z.ai港股盘中跌30%、MiniMax跌16%;Moonshot日收入增长至少6倍,估值锚从200亿美元抬向500亿美元;白宫科技政策办公室主任公开指控其蒸馏Anthropic技术,财政部长放话制裁,而英伟达、微软、Meta等25家美国公司联名上书,反对封杀开源模型——OpenAI、Anthropic、Google三家均不在首批名单上。
美国媒体对这件事的政治报道密度,已经超过技术报道本身。
从“宣称开源”到“文件落地”
7月16日到7月26日之间,K3在英文社区一直是一个“戴着开源新闻稿的API模型”——HuggingFace仓库返回404,开发者搜到的全是K2.7Code。Moonshot官方文档承诺的是“7月27日前发布全量权重”,多家海外技术媒体连续十天挂着倒计时页面。
今天权重落地,才算把承诺兑现。而这一天,恰好是华盛顿关于“要不要封杀中国开源模型”的争论最白热化的时刻。
核心参数(据官方模型卡与技术报告):
总参数/激活参数:2.8万亿/1040亿
架构:MoE,896个专家,每token激活16个
上下文窗口:100万token
多模态:原生视觉理解,视觉编码器MoonViT-V2
注意力机制:KimiDeltaAttention(KDA)覆盖93层中的69层,另有24层门控隐注意力
关键创新:AttentionResiduals、StableLatentMoE
效率:官方称相比K2实现约2.5倍的扩展效率提升
Moonshot称其为“全球首个3万亿参数级别的开放模型”。
许可证是今天最被低估的信息
真正的新变量不是权重本身,而是随权重一起发布的KimiK3License——一份“看起来像MIT,但在营收线以上另有条款”的定制协议。
Unite.AI逐条解读后指出,协议主体部分与MIT无异:任何人可免费使用、复制、修改、分发、再许可与销售,可部署、微调、构建衍生模型。但有两条附加义务。
第一,模型即服务(MaaS)条款。若被许可方向第三方提供推理或微调访问、且第三方对输入、参数或训练数据有实质控制权,当该主体及其关联方在任意连续12个月内收入超过2000万美元,须与Moonshot另签协议。
第二,署名条款。月活超过1亿、或月收入超过2000万美元的商业产品,须在界面显著位置标注“KimiK3”。
纯内部使用、通过Moonshot自有产品或其认证推理伙伴访问的,均不受约束。将模型嵌入某个具体功能、或仅做请求转发的产品,也不落入“服务”定义。
这份协议的实际效果,是按商业模式而非按用户切分。一个在自有基础设施上微调K3的团队,零义务;一个大规模转售K3推理的云厂商,必须先拿合同。这是中国头部模型公司第一次在开源许可里,把“云厂商搭便车”这件事写成了明码标价的商业条款。
第三名含金量大幅上升
独立评测机构ArtificialAnalysis在K3仅有API时给出IntelligenceIndex57分,全球第三,与ClaudeOpus4.8、GPT-5.5同档,落后于Anthropic的ClaudeFable5和OpenAI的GPT-5.6Sol。
真正刺眼的是它甩开其他开源模型的幅度:GLM-5.2为51分,DeepSeekV4Pro为44分。
智能体(agentic)维度更强。GDPval-AAv2拿到1668Elo,K2.6仅1190;AutomationBench-AA以53%位列全球第一;单任务成本0.94美元,接近GPT-5.6Sol,约为Opus4.8的一半。
前端编码是最出圈的一战。Arena的FrontendCodeArena采用人类盲测投票机制,K3上线当日拿到1679分登顶,在7个前端细分领域中的6个领先——相比K2.6的第18名,跃升17位。
Moonshot官方基准报GPQADiamond93.5%、BrowseComp91.2,但脚注坦承不同模型使用了不同的agentharness。官方发布文亦自陈整体性能仍落后于Fable5与GPT-5.6Sol,并点名用户体验存在差距。
权重开放的意义正在于此:从今天起,这些数字任何人都能自己跑一遍,不必再接受厂商harness下的结论。
价格:把闭源溢价的逻辑撕开一道口子
K3官方API定价为每百万token输入3美元、缓存输入0.3美元、输出15美元,全上下文窗口统一定价。作为对照,ClaudeFable5为10美元和50美元。TheWeek援引《金融时报》称,K3运行成本约为Opus4.8的三分之一;Axios的口径是便宜约40%。
但有两个反向变量必须说清楚,
其一,K3很“费token”。多位实测者反馈,完成同一任务它比Fable消耗更多token,叠加默认全开的maxreasoning推理模式与15美元的输出单价,单任务实际成本可能高于逐token对比所显示的水平。
其二,自托管不是省钱按钮。Moonshot建议在64个及以上加速器的超节点上部署,支持vLLM、SGLang、TokenSpeed。因为KDA破坏了常规前缀缓存,Moonshot专门给vLLM项目贡献了自研缓存实现。技术报告还提到一个容易踩的坑:K3以“保留思维历史”(preservedthinkinghistory)模式训练,harness必须把完整的前序assistant消息连同推理内容与工具调用一并回传,中途丢弃或从别的模型切换过来,输出会不稳定。
一句话:这是一个HuggingFace加集群加法务的三重事件,不是一个“下载即用”的App。
资本市场:先杀同行,再杀估值锚
K3首发那周,港股与中概AI板块出现了教科书式的同业绞杀:Z.ai港股盘中一度跌30%,MiniMax一度跌16%,阿里巴巴跌4%。美股方面,多家媒体提到芯片股受到波及。
而Moonshot自身的财务曲线陡峭得罕见。K3发布后,日收入至少增长6倍(彭博);6月ARR达3亿美元,4月还是2亿美元;5月刚以200亿美元估值完成20亿美元融资,由美团旗下龙珠投资领投;目前正在以500亿美元估值寻求新一轮融资,并筹备最快年内的港股IPO。
两个月,估值锚从200亿抬到500亿。K3就是那张定价单。
华盛顿:从“如何应对”变成“内讧”
指控层面。白宫科技政策办公室主任MichaelKratsios公开指控Moonshot通过蒸馏Anthropic的Fable5技术开发K3。他区分了两种情形:正当的AI蒸馏在开放创新生态中有重要作用,但“以窃取美国专有技术为目的的大规模、隐蔽的工业级蒸馏”不可接受。财政部长ScottBessent随后向CNBC表示,政府将调查中国公司是否窃取美国知识产权,并称“我们有能力因此对其实施制裁”。白宫官员与Anthropic将其定性为“IP盗窃”与“产业间谍”。中方否认相关指控,称其毫无根据。
政策工具箱。据Axios报道,商务部去年曾考虑将多家中国AI实验室列入实体清单,NSA与国家网络总监办公室曾权衡发布劝阻美企使用中国AI的建议,白宫曾考虑一项行政令——只有能保证安全并承担泄露责任的美国公司才可托管中国模型。这些措施当时均未落地。K3让它们全部重新变成可选项。
内讧层面。FastCompany的观察最尖锐:K3让美国前沿实验室看似舒适的领先优势瞬间收窄,而华盛顿与硅谷的第一反应是彼此开火。
OpenAI战略未来主管、前白宫AI顾问DeanBall称中国的开源路线是“彻底的AI共产主义”,并预判特朗普政府最终会意识到“最佳策略是围绕中国开源模型的使用制造大量监管风险”。值得注意的是,他同时承认K3“是个非常好的模型”,其性能无法用蒸馏来解释。
前白宫AI与加密事务负责人DavidSacks公开反驳:“对Kimi的恐慌必须停止,领先的美国模型仍然更强。”
美国创新基金会AI政策主任SamuelHammond说,华盛顿此前一直假设中国落后前沿数月,“美国情报界的职责之一,就是不被意外”。
MATS项目研究员KristyLoke表示,接近华盛顿的人士“确实有强烈兴趣禁掉这些模型”,但她提醒:绝大多数美国公司不是OpenAI或Anthropic,“大多数公司乐于拥有开源模型这个选项”,封禁会保护前沿实验室的收入,却抬高美国企业与初创公司的成本。
产业界的反击。7月24日,25家美国科技与投资机构联署公开信《OpenWeightsandAmericanAILeadership》,签署方包括英伟达、微软、Meta、IBM、戴尔、Palantir、a16z、HuggingFace、YCombinator、Mozilla、Mistral、Replit、Perplexity、Linux基金会等。信中主张:仅依赖闭源模型本身并不天然安全,它们同样可能被攻破、被滥用,或以外部无法察觉的方式失效;对非法蒸馏的关切应通过“有针对性的法律与商业框架”解决,而非“对创新中扮演重要角色的技术手段施加全面限制”。英伟达CEO黄仁勋用他在X上的首条帖子推广这封信,数小时内浏览量超过1100万。
谁没签,比谁签了更说明问题:OpenAI、Anthropic、Google均未在首批名单上。这三家恰恰是华盛顿封禁中国开源模型的最大受益方。Anthropic未签署且未就此信给出具体理由,其一贯立场是:公开发布强大模型权重会带来安全风险,因为访问权一旦释出便难以撤回。另据MLQ报道,该联署后续扩容至约50家,Google、OpenAI、微软、Meta、AMD等在列——此为后续动态,与首批名单存在口径差异,引用时需注明时点。
一个对冲性数据。据ArabiyaBusiness援引的英美联合评估,K3的网络安全能力得分为32.2%,而领先美国模型的平均分为76.2%,“远低于”后者。但BigGo的报道又提到,K3在27分钟内于一台Reddit服务器上发现零日漏洞的表现,同时让开发者和国安官员为之震动。两组信息并不完全冲突,但足以说明:关于K3到底构成多大安全风险,美方内部并没有共识。
最要命的是,任何人下载就能用
AIWeekly的总结点破了整件事的死结:本周Kimi头条底下的信号是政策,不是排行榜。
而政策面临一个物理上无法回避的事实——一旦权重上了互联网,它就在互联网上了。
更微妙的是同期发生的另一件事。据TheHill转引的报道,联邦官员此前曾要求Anthropic在亚马逊提出网络安全担忧后,将其最新Claude模型全球下架两周有余。一边是美国监管对本土实验室的强度前所未有,一边是任何人只要有服务器就能下载运行K3、全程不经过任何美国云。这构成了2026年AI治理最尴尬的一组对照。
另一个正在改变力量对比的数据:据byteiota引述OpenRouter数据,中国开源模型目前已占该多模型API网关路由token用量的46.4%,美国模型为35.7%。这是“封禁在技术上是否还来得及”这一问题的量化答案。
后市观察
对国内投资者与产业观察者,接下来30天有四个可验证的观测点。
第一,实体清单。Moonshot是否被列入。一旦落地,直接构成美国企业的采购合规风险,也会重定价其港股IPO的估值区间。
第二,行政令。白宫是否签署针对开源模型或中国模型输出责任的行政命令。截至7月25日,尚无行政令或立法通过,自托管KimiK3、Llama、Mistral、GLM目前不受任何现行法律限制。
第三,推理服务价格战。权重落地当日即是发令枪,所有推理服务商将在同一份权重上,围绕价格、延迟、量化质量与可靠性竞争。“同模型、不同服务”第一次成为真实的采购决策变量。这对英伟达是需求增量,对闭源API是价格压力。
第四,社区复现。技术报告已公开,KDA、AttentionResiduals、StableLatentMoE能否被独立验证,将决定“蒸馏说”的成色。这既是技术问题,也已经是地缘政治问题。
最后提示一个容易被中文舆论场忽略的定义问题。K3是open-weight(开放权重),不是open-source(开源)。你拿到的是权重、许可证和技术报告,训练数据与完整训练代码仍属Moonshot私有。英文技术社区对这条线划得极清楚,中文报道混用会直接影响可信度。
资料来源:Bloomberg、Fortune、CNBC、Axios(转引)、FastCompany、Quartz、VentureBeat、Tom‘sHardware、TheWeek(转引FT、CNN、Telegraph)、Unite.AI、TechNode、SiliconRepublic、ArtificialAnalysis、MoonshotAI官方模型卡与技术报告。截稿时间:2026年7月27日。

相关文章

头条焦点
精彩导读
关注我们
【查看完整讨论话题】 | 【用户登录】 | 【用户注册】