Kimi K3 开源权重 7 月 27 日发布:2.8 万亿参数、百万上下文,闭源溢价还守得住吗?

TL;DR:7 月 16 日 Kimi K3 已通过 API 上线;7 月 27 日 Moonshot 将在 Hugging Face 公开完整 2.8T 权重(Modified MIT)+ 技术报告。K3 不是「Fable 5 杀手」——AA Intelligence Index 57.1 排名第三——但以约 1/3 成本达到接近前沿的能力,且拥有闭源给不了的两样东西:开源权重 + 100 万 token 上下文

距 7 月 27 日权重发布还有 5 天。若你已在 7 月 16 日读过我们的 Kimi K3 深度评测,本文将把焦点移到开源权重发布本身:双线时间线、完整规格、基准胜负、API 真实成本、自部署硬件真相、行业意义、发布日核对清单、五步 Runbook 与 FAQ——覆盖选型与 SEO 决策所需的全部要点。

抽象神经网络可视化,象征 Kimi K3 即将在 Hugging Face 公开的大规模开源权重

内容目录

痛点拆解:为什么 7 月 27 日必须重估模型策略?

  1. 开源与闭源的能力差距在前沿基本闭合:AA Intelligence Index 中 K3 以 57.1 分排名第三(3/189),距 Claude Fable 5(59.9)仅差 2.8 分。差距从「数百分」缩到「两三分」,闭源厂商很难再纯靠能力证明溢价。
  2. 「开源 = 笔记本能跑」是最大误区:4-bit 权重约 1.4 TB,需 64+ 加速器超节点。WAIC hype 之后,不少团队会低估 CapEx,直到发布日才意识到自部署门槛。
  3. 两个日期、两种产品形态容易混淆:7 月 16 日是 API/产品上线;7 月 27 日才是 Hugging Face 权重 + Modified MIT + 技术报告。搜索「Kimi K3 下载」的流量将在 27 日爆发,提前布局内容才能吃到时效红利。

一、事件时间线

日期事件意义
2026-07-16Kimi K3 通过 Kimi App、Kimi Work、Kimi Code 和 API 上线;Artificial Analysis 同日发布独立评测开发者可立即调用 kimi-k3
2026-07-17上海世界人工智能大会(WAIC)开幕,新华社将 K3 定调为「国家级里程碑」中国 AI 梯队集体逼近:GLM-5.2、DeepSeek V4 Pro、MiniMax 同期发声
2026-07-27完整权重公开下载(Hugging Face,Modified MIT)+ 技术报告发布史上最大开源权重模型(2.8T)可下载
2026-07-27+vLLM KDA/prefix caching Day-0;Ollama/GGUF 社区量化跟进生态可用性决定自部署可行性

二、API 上线 vs 权重发布:别搞混两个日期

这是当前搜索困惑的最大来源:

英文社区严格区分 open weights(只放权重)与 open source(含训练代码/数据)。K3 属于前者——这本身是好内容,也是精准搜索词「kimi k3 open weights」的来源。

三、7 月 27 日开源发布:具体会发生什么

四、模型规格一览

项目数据
总参数量2.8 万亿(2.8T),史上最大开源权重模型
架构稀疏 MoE:Stable LatentMoE,896 个专家中每 token 激活 16 个
注意力机制Kimi Delta Attention(KDA,混合线性注意力)+ Attention Residuals(AttnRes)+ Gated MLA
上下文窗口1,048,576 tokens(约 100 万)
模态原生视觉理解(文本 + 图像,产品端还支持视频),输出为文本
权重格式MXFP4 权重 + MXFP8 激活(原生低精度训练,4-bit 量化接近训练精度)
扩展效率官方称比 K2 提升约 2.5 倍
训练稳定性Quantile Balancing(专家路由)、Per-Head Muon 优化器、SiTU 激活函数
长上下文解码KDA 在百万 token 上下文中最高 6.3 倍解码加速,KV 缓存减 75%

五、基准测试:赢在哪、输在哪

综合智能(Artificial Analysis Intelligence Index)

模型分数排名
Claude Fable 559.91
GPT-5.6 Sol58.92
Kimi K357.13 / 189

K3 领先或打平的项目

基准K3Fable 5Sol解读
Frontend Code Arena第 1盲测中开发者偏好其 UI 代码
Automation Bench第 129.129.7自动化任务
SpreadsheetBench 2第 1表格推理
BrowseComp91.288.090.4配合 1M 上下文无压缩策略
SWE Marathon42.035.039.0超长编码会话明显领先
Terminal Bench 2.188.384.688.8与 Sol 基本打平
Program Bench77.876.877.6微超 Sol
FrontierSWE81.286.671.3大幅超 Sol,但落后 Fable

K3 落后的项目

六、月之暗面的诚实态度(值得引用)

月之暗面在发布时罕见地主动承认综合性能仍落后 Claude Fable 5 和 GPT-5.6 Sol,并列出已知短板:对 harness 传回推理内容敏感、意图模糊时过于主动等。K3 不是「Fable 5 杀手」,但以约 1/3 成本达到「接近前沿」的能力——这对闭源溢价叙事是直接冲击。

七、API 定价与真实成本

项目价格(每百万 tokens)
输入(缓存未命中)$3.00
输入(缓存命中,自动缓存)$0.30
输出$15.00

八、自部署现实:别被「开源」骗上笔记本

7 月 27 日发布日核对清单

□ Hugging Face 仓库文件是否齐全(分片、索引、Model Card) □ LICENSE 原文(Modified MIT 具体条款) □ 技术报告 PDF / arXiv 链接 □ 量化版本说明(MXFP4 / NVFP4 / GGUF roadmap) □ vLLM / SGLang 启动命令与 KDA prefix caching 文档 □ 最低可行硬件与超节点配置建议 □ 独立长上下文复测基准与方法说明 □ Ollama manifest 预计时间表

可引用技术信息(EEAT)

九、API vs 自部署:三场景决策矩阵

场景推荐路径原因
初创 / PoC / 个人开发者API 或 OpenRouter零 CapEx,5 分钟接入,缓存命中后成本极低
中型团队 / 混合路由API + Fable 5 / Sol 并存长代码 K3,FrontierSWE 级修 Bug 用 Fable,终端 Agent 用 Sol
大型企业 / 数据不出域64+ 卡自部署 + API 备用Modified MIT 允许商用微调,但 MLOps 成本极高

十、行业意义:闭源溢价还守得住吗?

  1. 开源与闭源能力差距在前沿基本闭合:差距从「数百分」缩到「两三分」,闭源厂商很难再纯靠能力证明溢价。
  2. 地缘背景:发布赶在 WAIC 前;一个月前美国政府曾短暂下架 Anthropic 的 Fable/Mythos 模型(7 月 1 日恢复),「监管可以关掉闭源模型,但关不掉已发布的开源权重」成为开源叙事的新论据。
  3. 中国厂商梯队集体逼近:Z.ai GLM-5.2(编码对标 Opus 4.8、价格 1/5)、DeepSeek V4 Pro(1.6T)、MiniMax 等,K3 是这波浪潮的最高点。
  4. 月之暗面的翻身仗:2025 年初被 DeepSeek R1 冲击后排名跌至国内第七,靠 K2(2025-07)→ K2.5(2026-01)→ K3 的开源路线重建地位。

十一、五步发布日 Runbook

步骤 1 7/27 当天 2 小时内:打开 Hugging Face repo,核对 LICENSE、权重分片、Model Card 步骤 2 下载并阅读技术报告,确认 KDA/Stable LatentMoE/MXFP4 与官方 blog 一致 步骤 3 按流量选择 API(platform.kimi.ai)或 64+ 卡自部署;低流量团队勿急于自建 步骤 4 配置 vLLM KDA + prefix caching;Ollama/GGUF 仅作 PoC,勿用于生产全量 2.8T 步骤 5 Pilot 10–20 次 SWE Marathon 类任务,记录缓存命中与幻觉;上线混合路由并持续更新 benchmarks 段落(7/28–30 追社区独立复测)

十二、FAQ

Q: Kimi K3 权重什么时候发布?

A: 2026 年 7 月 27 日,Hugging Face 完整 2.8T 权重 + Modified MIT + 技术报告同步公开。

Q: K3 真的开源吗?

A: 准确说是 open weights:提供完整权重与 Modified MIT,不含训练代码/数据。与 fully open source 有区别。

Q: K3 多少钱?

A: API $3/$0.30 缓存/$15 per M tokens;AA 单任务约 $0.94,比 Fable 5 低 65.8%。kimi.com 免费账号可试用。

Q: 能在消费级 GPU 上跑吗?

A: 不能。4-bit 约 1.4 TB + 64+ 加速器。笔记本与普通 VPS 不现实。

Q: K3 比 Fable 5 / Sol 强吗?

A: 综合排名第三;编程长任务、Frontend Code Arena、BrowseComp 等赛道领先,但 GDPval Elo、DeepSWE、对话稳定性仍落后。

Q: 用什么许可证?

A: Modified MIT,7/27 发布日公布 LICENSE 原文,允许研究与商用(具体以 HF 仓库为准)。

总结

7 月 27 日的 Kimi K3 开源权重发布,是首个 2T+ 级、AA Index 第三、Modified MIT 商用可下载的组合——对闭源溢价叙事构成结构性冲击。Moonshot 主动承认排名第三与幻觉上升,反而增强了 E-E-A-T 可信度。对大多数团队,Q3 2026 的理性解法是 API + 混合模型路由,而非在发布日仓促自建超节点。

但若你把 K3 Agent 完全跑在个人笔记本、普通 Linux VPS 或无 macOS 的 CI 上,仍会面临长循环中断、API Key 与生产代码库混存、无法同机编排 Xcode/Fastlane/notarytool等局限。对于需要 7×24 Kimi Code + K3 长代码 Agent 同时又要做 iOS 签名或 OpenClaw 网关的团队,租赁 VPSMAC 的 M4 Mac 云节点——原生 macOS、SSH + launchd 守护——通常比个人设备或 Linux VPS 更稳定、更适合混合模型策略的生产环境。

参考资料: Moonshot 官方技术博客 · Kimi API 文档与定价 · Artificial Analysis(Intelligence Index 57.1,7 月 16 日)· VentureBeat / Northflank 自部署分析 · r/LocalLLaMA / Hacker News 社区讨论 · 关联阅读:Kimi K3 深度评测(7/16 API 上线)

数据截止日期:2026-07-22。 7 月 27 日发布日当天请更新 HF 直链、LICENSE 原文与实际文件清单;Google 对时效性内容重排很快,这一步是拿「K3 权重下载」流量的关键。