没人把顶级大模型真的开源过,直到 Kimi K3
2026.07.29·一手技术报告拆解·约 2200 字在2026年7月29号之前开源模型和顶级模型之间一直隔着一条心照不宣的线。开源社区能拿到的一直是够用的模型——参数规模停在千亿级能力落后旗舰闭源模型一到两代大家心里都清楚真正站在能力顶端的那几个模型GPT、Claude从来不会把权重放出来。这不是技术问题是选择问题——没有一家公司愿意把自己最强的东西白送出去。7 月 27 日晚上 11 点 13 分这条线第一次被跨过去了。月之暗面把 Kimi K3 的权重、47 页技术报告、连同背后的核心基础设施全部开源而这个模型的能力水平第一次真正逼近甚至超过了 GPT-5.6 Sol 和 Claude Fable 5 这两个最新的闭源旗舰。这不是开源模型又追近了一点这是第一次顶级水平和开源权重同时出现在了同一个模型身上。1同等水平不是营销话术是可以摆数字对比的事实先把最容易被忽略、也最容易被夸大的一点说清楚K3 到底强到什么程度不需要用形容词直接看它和两个闭源旗舰的对比。编程能力上K3 在 SWE-Marathon 这个长程编程基准上拿到 42.0%比 Claude Fable 5 的 35% 高出 7 个百分点ProgramBench 上以 77.8% 拿到全场最高分。Agent 能力上BrowseComp真实网页浏览与信息检索任务K3 拿到 91.2%同样是第一名而且完成每个任务的成本只要 GPT-5.6 Sol 的一半。更直接的对比是 Kimi Code BenchK3 的得分只比 Claude Fable 5 低 4 分但花费只要对方的 38%。放到企业采购最关心的 GDPval 场景里K3 比 GPT 便宜 13%比 Claude 便宜 2.6 倍。图 1K3 在多个关键指标上对齐甚至超过闭源旗舰这些数字共同说明一件事K3 不是在某个细分任务上偏科式地跑赢了一次而是在 编程、Agent、多模态这几条主线上同时站到了和两大闭源旗舰同一个量级——而且是以对方三分之一到一半的成本做到的。2能做到这一步靠的不是堆参数是把两条路一起走到头硅星人Pro 拆解了 K3 的 47 页技术报告后指出了一个此前被大多数人忽略的关键判断大模型的能力提升其实有两条完全不同的轴——一条是部署前投入更多算力和数据把模型做大另一条是部署后投入更多算力做长时间推理和强化学习。过去两年开源社区几乎只在第二条轴上使劲模型规模始终停留在千亿级别而 K3 是第一个把两条轴同时推到前沿的开源模型——总参数达到 2.78 万亿是上一代 K2 的两倍多同时相比 K2 整体 scaling 效率还提升了约 2.5 倍。图 2规模 × 推理双轴驱动重新定义开源模型的能力上限这背后是一整套架构上的重新设计用 KDA 线性注意力和门控 MLA 混合的方式处理长上下文把位置编码整个去掉让模型能稳定处理 100 万 token 的上下文专家网络用到 896 个但每次只激活 16 个把计算成本死死摁住。这套设计不只是让 K3 变强还反过来影响了整个开源生态——K3 团队把 DeepSeek V4 的核心算子 DSA 又提速了 55.1%这在过去是开源社区向头部模型学习的方向这次反过来了。3真正的门槛不是答得好是能不能一直做下去AI科技评论的技术拆解点出了另一个更容易被忽略、但可能是这次最重要的变化当一个模型需要连续工作几个小时去完成一个真实任务时决定它上限的已经不是下一句话说得好不好而是它能不能记住已经做到哪一步、能不能看到真实的执行结果、能不能在出错之后接着把任务做完。图 3长程 Agent 能力的突破让模型像真正能顶岗的员工这才是长程 Agent 能力真正难的地方也是过去开源模型普遍卡住的地方。K3 为此专门设计了一套叫 AgentENV 的基础设施用轻量虚拟机跑任务沙箱累计创建了超过 5100 万个单个沙箱的存档只要 133 毫秒、恢复只要 49 毫秒。配合partial rollout这种异步执行机制长任务不会因为要等一整批任务同时完成而被卡住。这套东西解决的不是模型聪不聪明而是 “模型能不能像一个真正能顶岗的员工一样扛得住一整段不被打断的工作”——这恰恰是企业愿意为 Agent 付费的核心诉求。4这次行业反应有多大看这几个数字就知道不是自嗨K3 上线一小时内就冲到 Hugging Face 趋势榜第一30 分钟内拿到超过 4000 个点赞Hugging Face 联合创始人称这是他们见过增长最快的一次模型发布。真正说明这件事分量的是随后的连锁反应。7 月 24 日黄仁勋发出了他人生的第一条 X 帖子牵头发起《开放权重与美国 AI 领导力》公开信首发只有 25 家机构签署到周末暴涨到 77 家最终签署机构超过 100 家——微软、Meta、IBM、AMD、Hugging Face、Linux 基金会甚至此前一直是闭源阵营代表的 OpenAI 和 Google 也加入了进来。英伟达同时牵头成立了 Open Secure AI Alliance联合近 40 家科技公司围绕开放权重模型搭建安全基础设施。另一边由 YC、Replit、Proton 等近 200 家硅谷创业公司组成的 Little Tech 联盟公开警告如果封禁中国开源模型会有数百家美国初创公司在短时间内失去赖以生存的技术底座。而 Anthropic 则被卷入了不太舒服的位置——不得不专门发长文回应解释自己没有跟进开源的原因。图 4从模型开源到生态共振K3 撬动了整个行业的连锁反应这场反应之所以这么大是因为它触碰到了每家公司都很清楚、但很少被摆到台面上的一个变化黄仁勋自己给出的判断是前沿智能正在第一次变成一种可以下载、可以迁移的基础资产。当能力和权重开始同时开源模型层本身的稀缺性就在下降行业的价值开始往算力、Agent 框架、企业数据这些环节转移——这对所有靠模型能力独家赚钱的公司都是一次真实的地基松动。值得一提的是K3 的许可证设计也很清楚地表明了这不是一次公益行为而是一步算好的商业棋普通开发者和公司可以免费使用、修改、商用几乎没有门槛只有当一家公司靠 K3 提供模型服务、连续 12 个月总收入超过 2000 万美元或者商业产品月活超过 1 亿、单月收入超过 2000 万美元时才需要额外签协议或者在产品里显著展示 Kimi K3。换句话说月之暗面愿意把顶级能力免费送给绝大多数人但真正靠这个模型赚到大钱的少数公司需要付出代价——这是一次精确计算过的开放不是一时冲动。5分水岭真正的意义是往前看回头看这条一直没人跨过的线会发现它之所以一直没被跨过不是因为技术做不到而是因为没有一家真正站在能力顶端的公司愿意承担把自己最强模型开源出去的商业风险。K3 这次给出的答案是这笔账是可以算得过来的。免费开放绝大多数使用场景换来的是生态位——开发者的信任、开源社区的贡献、以及在下一轮竞争里谁的技术底座被更多人依赖这个更长远的筹码。往后看这件事至少会推着行业往两个方向走。一是闭源模型的定价逻辑会被迫改变——当一个成本只要三分之一到一半的开源选项在能力上打平甚至反超闭源阵营很难再靠我们更强这一条理由维持原有的价格黄仁勋自己也说过开源模型未必会终结闭源模型但正在倒逼它们开始节流。二是接下来的竞争焦点会从谁的模型分数更高转移到谁能把开源出来的能力更快地嵌进真实的工作流里——模型本身不再是稀缺资源之后怎么用好它才是真正拉开差距的地方。这大概就是分水岭这个词该配得上的分量不是一次跑分的胜利而是一条原来被认为不会被跨过的线被真正跨过去了。我会持续跟踪大模型、AI 生态这些方向的一手信息读技术报告、拆产业逻辑尽量把行业里正在发生但还没被讲清楚的判断说明白。—— 欢迎关注我的公众号一起看接下来会发生什么。

相关新闻

AI写作的结构困境与突破方法

AI写作的结构困境与突破方法

1. Seedance 2.0时代的创作困境去年用AI辅助写作时发现一个有趣现象:当我把《三体》章节喂给GPT要求仿写时,生成的段落虽然词汇华丽,但总感觉少了点什么。直到重读原著才意识到问题所在——AI能模仿词句,却复制不了大刘那种"…

2026/7/31 3:43:44 阅读更多 →
存量校园信息化效能跃升 智圣新创数据驱动智慧校园升级的通用落地路径

存量校园信息化效能跃升 智圣新创数据驱动智慧校园升级的通用落地路径

随着教育数字化战略行动的持续推进,全国高校普遍完成了第一轮数字化校园基础建设,大量建设于“十三五”期间的业务系统陆续进入效能释放的关键节点,如何破解存量系统的数据孤岛痛点,用更低的投入实现智慧校园服务能力的升级&#…

2026/7/31 3:43:44 阅读更多 →
开关电源DCM模式四大不利影响分析与系统性规避实战

开关电源DCM模式四大不利影响分析与系统性规避实战

1. 项目概述:从一次电源啸叫说起 前段时间在调试一个给户外设备供电的紧凑型反激电源时,遇到了一个让人头疼的问题:在轻载条件下,电源模块会发出一种高频的“滋滋”声,同时用示波器测量输出电压,能看到明显…

2026/7/31 3:42:44 阅读更多 →

最新新闻

Kimi K3开源大模型:1M上下文本地部署与长文本处理实践

Kimi K3开源大模型:1M上下文本地部署与长文本处理实践

这次我们来看一个备受关注的开源大模型项目——Kimi K3。这个由月之暗面(Moonshot AI)推出的模型最近宣布开源,最引人注目的特点是支持1M(100万)上下文长度,这意味着它能处理约200万汉字的长文本内容。对于…

2026/7/31 4:16:54 阅读更多 →
小米平板1刷机救砖指南:解决TWRP Error 7与Error 255错误

小米平板1刷机救砖指南:解决TWRP Error 7与Error 255错误

1. 从一次深夜救砖行动说起如果你也像我一样,是个喜欢折腾老旧设备、试图让它们焕发第二春的玩家,那么“刷机”这个词对你来说一定不陌生。它既是乐趣,也是风险。就在上周,我翻出了抽屉里吃灰多年的小米平板1代,想给它…

2026/7/31 4:16:54 阅读更多 →
华为OD机考双机位C卷:服务器网络连通域解题指南

华为OD机考双机位C卷:服务器网络连通域解题指南

1. 项目概述:华为OD机考双机位C卷实战解析最近在准备华为OD机考的朋友们,应该对"可以组成网络的服务器"这道题目不陌生。作为C卷的经典题型,它考察的是图论中的连通域问题,在实际工作中对应着服务器集群管理、网络拓扑分…

2026/7/31 4:16:54 阅读更多 →
Java爬虫工程化实践:从HTTP请求到分布式架构的完整指南

Java爬虫工程化实践:从HTTP请求到分布式架构的完整指南

1. 从“数据搬运工”到“信息架构师”:为什么今天还要学Java爬虫?最近在技术社区里,看到不少朋友在讨论Python爬虫,各种框架、库层出不穷,上手快,几行代码就能抓点数据。这让我想起十年前,我刚入…

2026/7/31 4:16:54 阅读更多 →
Ubuntu下Python虚拟环境搭建:venv、virtualenv与pipenv对比与实践

Ubuntu下Python虚拟环境搭建:venv、virtualenv与pipenv对比与实践

1. 项目概述:为什么我们需要Python虚拟环境?如果你在Ubuntu上写过Python,大概率遇到过这样的场景:项目A需要Django 3.2,项目B需要Django 4.2,而系统全局安装的包版本只有一个。更头疼的是,当你尝…

2026/7/31 4:16:54 阅读更多 →
现代Web截图解决方案:modern-screenshot架构解密与生产环境实践指南

现代Web截图解决方案:modern-screenshot架构解密与生产环境实践指南

现代Web截图解决方案:modern-screenshot架构解密与生产环境实践指南 【免费下载链接】modern-screenshot 📸 Quickly generate image from DOM node using HTML5 canvas and SVG. 项目地址: https://gitcode.com/gh_mirrors/mo/modern-screenshot …

2026/7/31 4:15:54 阅读更多 →

日新闻

物理复制比逻辑复制好在哪?数据库复制原理详解

物理复制比逻辑复制好在哪?数据库复制原理详解

数据库复制是把主库数据同步到备库的机制,分为逻辑复制和物理复制两种。逻辑复制传输的是 SQL 语句或行变更事件,物理复制传输的是存储引擎底层的物理日志。阿里云 PolarDB(云原生数据库)采用物理复制,在同步延迟、数据…

2026/7/31 0:00:34 阅读更多 →
BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南

BilibiliDown:3分钟学会B站视频下载的终极指南 【免费下载链接】BilibiliDown (GUI-多平台支持) B站 哔哩哔哩 视频下载器。支持稍后再看、收藏夹、UP主视频批量下载|Bilibili Video Downloader 😳 项目地址: https://gitcode.com/gh_mirrors/bi/Bilib…

2026/7/31 0:00:34 阅读更多 →
有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

有哪些游戏数据AI平台?游戏行业Data+AI融合方案盘点

当前,游戏行业的“DataAI融合”已从概念验证进入价值落地阶段。根据IDC 2025年数据,中国AI游戏云市场规模已达18.6亿元;同时,游戏研发环节AI渗透率高达86%,生成式AI内容普及率超过50%。面对庞大的市场,游戏…

2026/7/31 0:00:34 阅读更多 →

周新闻

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 道路桥梁裂缝检测数据集 道路桥梁病害识别检测数据集

深度学习道路桥梁裂缝检测系统 数据集6000张 完整源码已标注数据集训练好的模型环境配置教程程序运行说明文档,可以直接使用!系统支持图片、视频、摄像头等多种方式检测裂缝,功能强大实用。 1数据集6000张 8各类别

2026/7/31 1:03:03 阅读更多 →
深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

深度学习YOLO模型如何训练 PUBG 绝地求生目标检测数据集

pubg数据集 精选原图1.42万数据 1.49万标签 无任何重复、算法增强或冗余图像! pubg绝地求生目标检测数据集 1分类:e_body,14905个标签,txt格式 共计14244张图,99%为640*640尺寸图像 适合yolo目标检测、AI训练关键词&am…

2026/7/29 14:34:28 阅读更多 →
Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex英雄目标检测数据集 深度学习框架YOLO如何训练APEX数据集

Apex检测数据集数据集详情检测类别: allies enemy tag图片总量:7247张训练集:5139张验证集:1425张测试集:683张标注状态:全部已标注,即拿即用数据格式:支持YOLO格式及其他格式&#…

2026/7/29 15:00:03 阅读更多 →

月新闻