Kimi K3发布一周暂停新用户订阅,开源模型竞争进入新阶段!
发布即火爆Kimi K3暂停新用户订阅因为太过火爆距离Kimi K3发布不到一周月之暗面就按下了 暂停键。7月19日晚月之暗面宣布由于算力资源紧张暂停开放Kimi新用户订阅将有限算力优先保障现有订阅用户。 图源月之暗面7月20日月之暗面回应界面新闻称此次调整仅涉及新用户订阅现有会员权益保持不变老套餐并未取消已订阅用户仍可正常使用并按原规则自动续费。对于此前手动关闭自动续费的用户公司将陆续恢复续订功能老用户升级套餐等功能也将逐步开放至于新套餐目前仍因算力资源限制暂未开放购买恢复时间尚未确定。从官方回应来看此次调整更像是在有限算力资源下对新增用户和存量用户体验进行重新平衡而非对会员体系进行调整。评测成绩亮眼K3引发业内关注K3发布后国内外开发者社区迅速涌现大量体验和测评不少人将它与Claude、GPT等国际头部模型放在一起比较围绕推理成本、GPU资源、服务稳定性的讨论也开始取代Benchmark成为AI圈新的焦点。我不禁想问K3到底有多火它发布后很快登上了全球AI模型讨论的焦点。独立AI模型评测机构Artificial Analysis发布的最新 智能指数Intelligence Index 显示Kimi K3综合得分达到57分位列全球第三仅次于Claude Fable 560分和GPT - 5.6 Sol59分领先Claude Opus 4.856分。与此同时K3完成单项任务的平均成本约0.94美元与GPT - 5.6 Sol基本相当仅约为Claude Opus 4.8的一半。对业内而言更重要的是这是首个进入Artificial Analysis综合榜单前三的开源模型。长期以来“开源模型整体落后闭源模型半代”几乎是行业共识而K3的出现让这一差距进一步缩小。图源Monolith励思资本除了评测成绩K3本身的参数规模同样引发业内关注。K3是月之暗面首款万亿参数级MoE模型总参数规模达到2.8万亿。一位国产AI芯片厂商人士向界面新闻表示今年以来随着Anthropic等海外厂商不断推出更大参数模型国内模型竞争再次回到“大参数、长上下文”赛道万亿参数、百万级上下文正成为头部模型的重要竞争方向。在他看来K3之所以迅速“出圈”不仅因为模型能力更因为它意味着国产开源模型首次进入这一量级。“对于行业来说2.8T本身就是一个重要信号。”开发者社区热议K3优缺点并存业内关注很快传导到了开发者社区。在XTwitter、Reddit、OpenRouter、Linux.do、V2EX等平台大量开发者第一时间分享体验不少人将K3接入Cursor、Cline、OpenCode等AI编程工具进行测试。从代码生成、Agent任务到工具调用K3几乎成为过去几天AI圈讨论最多的模型之一。讨论几乎集中在三个问题第一它到底能不能替代Claude做编程第二它是否真的达到国际第一梯队第三它到底值不值得迁移不少开发者认为K3最大的亮点并非聊天而是在长流程Agent任务和代码生成场景。一些体验者表示在复杂代码修改、工具调用等任务中K3已经能够进入Claude、GPT等国际头部模型的竞争序列。但也有反馈称在真实工程任务中该模型虽然能力突出但仍会遗漏部分细节需要人工修正此外其复杂统计推理等任务表现仍存在不稳定情况。另一类讨论则集中在成本。有用户认为K3虽然单价具有竞争力但由于复杂任务Token消耗较大实际使用成本未必低于预期尤其是在长流程Agent任务中更为明显。海外AI圈关注评价褒贬不一K3的热度也迅速传导到了海外AI圈。美国科技投资机构Atreides Management创始人Gavin Baker将K3称为AI发展的一个“拐点inflection point”他认为高质量开源模型正在加速AI能力扩散其影响不会局限于模型厂商而将惠及整个AI应用生态。 也有研究者保持谨慎。长期研究人工智能对工作影响的宾夕法尼亚大学沃顿商学院教授Ethan Mollick在X上表示他曾让Kimi K3对自己此前的一项学术研究进行复杂统计审计但模型“在很多方面都搞砸了”包括错误使用统计分析方法。Mollick认为K3已经非常接近全球领先模型但复杂专业任务中的可靠性仍需更多真实场景验证而不能仅依据Benchmark成绩作出判断。这一评价也反映出当前AI社区对新模型的一种普遍态度一方面K3在代码生成、Agent等场景的表现获得了大量开发者认可另一方面模型在复杂专业任务中的稳定性和可靠性仍需要更多真实场景的持续验证而不能仅依据榜单成绩作出判断。算力紧缺成瓶颈大模型竞争进入新阶段算力紧缺仍是瓶颈。也正是在开发者快速涌入、调用量持续攀升的背景下月之暗面很快遇到了另一个问题——算力。过去两年大模型行业更常见的叙事是“训练一个模型需要多少GPU”、“参数规模达到多少”而不是因为用户太多不得不暂停开放订阅。事实上训练完成并不意味着算力投入结束尤其是在AI Coding、Agent等场景快速发展的背景下模型需要持续调用工具、读取上下文、执行多轮推理一个请求占用GPU资源的时间远高于传统聊天场景。模型能力越强、上下文越长、用户调用越频繁对推理算力的消耗也越高。“今天最大的问题还是缺算力尤其是高质量的推理算力。”上海国投孚腾资本投资总监陈雨沁此前接受界面新闻采访时表示即便是头部模型公司也已经开始取消无限量使用、提高服务价格本质上都反映出推理资源依然紧张。“如果基础设施没有解决很多应用公司其实不敢真正大规模推广产品。”“从供需关系来看国内AI算力长期处于供不应求状态而随着头部模型集中发布这种紧张局面会进一步放大。”上述芯片产商人士向界面新闻称。他介绍目前像月之暗面、智谱、MiniMax等独立模型公司获取算力主要依赖两种方式一是租用公有云厂商的算力服务二是建设自有算力集群。但前者资源有限后者属于重资产投入需要较长建设周期因此模型厂商的算力供给始终存在一定压力。“业内普遍认为支撑万亿参数模型训练和推理万卡级集群已经成为基础门槛。”他表示从2024年至今真正具备万卡级部署能力的厂商仍然是少数不少已经宣布建设的大规模集群项目落地周期往往以年计算因此供需之间仍存在长期缺口。今年WAIC期间一个细节让上述国产芯片厂商印象深刻。他告诉界面新闻各家国产芯片厂展示超节点产品时被问得最多的两个问题就是“能不能支持万卡集群”“能不能支持万亿参数模型训练”相比过去围绕单卡性能、芯片参数展开讨论如今产业链更加关注的是超大规模集群能力以及支撑头部模型持续训练、推理的基础设施。这一变化也折射出大模型竞争逻辑的变化。过去模型公司比拼的是参数规模、训练能力和Benchmark成绩如今随着越来越多模型进入真实生产环境推理效率、服务稳定性、成本控制以及基础设施能力开始成为新的竞争维度。K3暂停开放新用户订阅也许只是一次短暂的资源调配却让外界第一次如此直观地看到大模型竞争已经进入新的阶段。模型能力决定产品能否吸引用户而推理算力、基础设施和持续服务能力则决定它能否承接真正的大规模应用。那么在这场新的竞争中K3能否脱颖而出呢

相关新闻

3步掌握LTX-2视频生成:ComfyUI-LTXVideo完整使用指南

3步掌握LTX-2视频生成:ComfyUI-LTXVideo完整使用指南

3步掌握LTX-2视频生成:ComfyUI-LTXVideo完整使用指南 【免费下载链接】ComfyUI-LTXVideo LTX-Video Support for ComfyUI 项目地址: https://gitcode.com/GitHub_Trending/co/ComfyUI-LTXVideo 你是否渴望创作电影级的AI视频,却被复杂的模型配置和…

2026/7/22 22:43:18 阅读更多 →
AI算力调度:GPU集群编排、混部与降本实践

AI算力调度:GPU集群编排、混部与降本实践

引言一张A100的采购价超过十万,云上单卡月租上万,但大多数公司的GPU平均利用率只有20%到40%。训练任务白天排队、夜里空跑,推理服务按峰值配资源、平时大半闲置,算法团队之间互相抢卡——这些场景几乎每家有GPU集群的公司都在上演…

2026/7/22 22:43:18 阅读更多 →
AI持续学习:对抗灾难性遗忘的工程实践

AI持续学习:对抗灾难性遗忘的工程实践

引言模型上线不是终点,而是学习的起点。推荐系统每天有新用户行为,风控模型每月面对新的欺诈手法,语音助手要不断学新方言。理想情况是模型像人一样持续吸收新知识,但现实很骨感:用新数据直接微调,旧任务上…

2026/7/22 22:43:18 阅读更多 →

最新新闻

企业级AI搜索落地选型实战手册(含LLM+RAG+Hybrid架构对比矩阵与ROI测算模板)

企业级AI搜索落地选型实战手册(含LLM+RAG+Hybrid架构对比矩阵与ROI测算模板)

更多请点击: https://kaifayun.com 第一章:企业级AI搜索落地选型实战手册(含LLMRAGHybrid架构对比矩阵与ROI测算模板) 企业级AI搜索系统落地成败,核心在于技术选型与业务价值的精准对齐。盲目堆砌大模型能力或过度依赖…

2026/7/23 0:10:28 阅读更多 →
AI写作开头钩子设计实战指南(2024爆款开头拆解库):覆盖电商/知识付费/短视频全场景

AI写作开头钩子设计实战指南(2024爆款开头拆解库):覆盖电商/知识付费/短视频全场景

更多请点击: https://intelliparadigm.com 第一章:AI写作开头钩子设计的核心认知与底层逻辑 AI写作的开头钩子并非修辞技巧的堆砌,而是用户注意力机制、语言模型概率建模与信息熵压缩三者协同作用的结果。当读者在3秒内决定是否继续阅读时&a…

2026/7/23 0:10:28 阅读更多 →
【限时解密】GitHub Star破万的AI性能分析工具链:未公开的AST级代码热点标注技术

【限时解密】GitHub Star破万的AI性能分析工具链:未公开的AST级代码热点标注技术

更多请点击: https://intelliparadigm.com 第一章:【限时解密】GitHub Star破万的AI性能分析工具链:未公开的AST级代码热点标注技术 在主流LLM驱动的代码分析工具仍停留于行级或函数级统计时, ast-hotspot(GitHub sta…

2026/7/23 0:10:28 阅读更多 →
AI设计工作流不是工具堆砌!20年设计系统专家首次公开:4个反直觉但高ROI的集成原则

AI设计工作流不是工具堆砌!20年设计系统专家首次公开:4个反直觉但高ROI的集成原则

更多请点击: https://kaifayun.com 第一章:AI设计工作流不是工具堆砌!20年设计系统专家首次公开:4个反直觉但高ROI的集成原则 设计团队常误将AI工作流等同于“Figma插件 Midjourney Notion AI”的简单叠加,结果陷入…

2026/7/23 0:10:28 阅读更多 →
TM4C129LNCZAD外设实战:LCD、比较器与PWM寄存器配置详解

TM4C129LNCZAD外设实战:LCD、比较器与PWM寄存器配置详解

1. 项目概述与核心价值在嵌入式系统开发,尤其是基于ARM Cortex-M内核的微控制器项目中,深入理解并熟练配置芯片的片上外设,是从“点亮LED”迈向“实现复杂系统功能”的关键一步。Tiva™ TM4C129LNCZAD作为TI公司Cortex-M4F家族中的高性能成员…

2026/7/23 0:09:27 阅读更多 →
AtomCode Ctrl+O 探秘:从工具输出到推理可见的完整演进史

AtomCode Ctrl+O 探秘:从工具输出到推理可见的完整演进史

一、快速声明CtrlO(macOS 上即 CtrlO)是 AtomCode TUI 中切换 verbose 模式的快捷键,控制实时工具输出和模型推理内容的可见性。本文基于 AtomCode 仓库 main4677ddfa 及全分支 Git 历史,从源码路径、演进历程、分支差异三个维度给…

2026/7/23 0:08:27 阅读更多 →

日新闻

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:25 阅读更多 →
AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

更多请点击: https://codechina.net 第一章:AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析 在对2,346篇跨行业AI生成文案的A/B测试数据进行聚类分析后,我们发现&#xff1…

2026/7/23 0:01:26 阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:01:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/22 12:54:44 阅读更多 →

月新闻