会员销售暂时搁置了。 (doge)
主要原因嘛,就是使用者实在太多。
请求量已经冲到了现有集群的承载上限,GPU被用到冒烟程度,算力直接 《告急》。
已经在使用的用户可以继续使用,还没购买的用户,估计只能先排队等候了。
确实,这也算大模型被活生生「累」到限流的案例……
Kimi K3上线两天,火到连会员都「停售」了
模型如此受欢迎,其实也容易理解——
主要原因,还是模型性能确实很「强」……
Kimi K3是月之暗面前两天发布的新一代旗舰模型,也是全球首个开源的3万亿参数级模型。
在代码竞赛中,Kimi K3以1679分排名第一,直接超越Fable5,并且打败了GPT-6.6 Sol~
不仅如此,在其他编程评测里,Kimi K3的表现也非常出色——
在DeepSWE上,Kimi K3获得67.5分,低于Fable 5的70.0分和GPT-5.6 Sol的73.0分。
在Program Bench上,Kimi K3获得77.8分,略微领先Fable 5的76.8分。
在长程软件工程能力的SWE Marathon上,K3更是拿到42.0分,排在所有参评模型的第一位:
如此出色的模型摆在眼前,自然有很多人想试用一番!!
因此,除榜单排名外,网友们很快就玩得热火朝天——
一方面,大批开发者快速展开应用,重点在于: Kimi K3大舞台,想做什么就做什么!
网页、游戏、3D场景、交互应用……各种创意层出不穷,K3很快成为了一个大型赛博游乐场~
比如下面这位网友用Kimi K3开发出开放世界游戏,坦言几个月前还几乎不可能实现的事情,现在居然真的做到了,Unbelievable!
另一方面,还有一群网友设置了「模型擂台」,邀请Kimi K3和海外主流模型进行对比。
比如下面这位用户,让Kimi K3和Opus 4.8分别生成了一个虚拟仓库空间。
经过对比后网友直言Opus 4.8表现一般,而Kimi K3在场景完整度和画面细节上更为优秀~
模型能力强、榜单成绩优异、实测效果出众,这类好东西自然吸引众多用户《盘一盘》。
因此,越来越多的用户开始集中涌向Kimi。
接着,剧情逐渐朝向服务器最不希望看到的方向发展了:
模型请求量急速上升,算力接近饱和状态。
到了7月19日晚,Kimi团队正式发布一则公告,大致意思是——
所有人都感受到了大家的热情,连俺家的GPU都感受到了~ (doge)
K3上线后的火爆程度,确实比官方预期的要强得多。
短短48小时,模型请求量就大幅超过预估峰值,逼近现有集群的负载极限。
毕竟每次模型调用,都需要GPU完成一次推理计算,同时进入的请求越多、任务越复杂,使用的算力就越大。
当调用量超过集群可以同时处理的上限,响应速度就会变慢、出现排队,甚至直接「瘫痪」了。
眼看GPU快要不堪重负了,Kimi只能紧急采取措施——
简单来讲,已经使用的用户可以继续使用,还没购买的用户,只能先等待(doge)。
根据官方计划, 未来Kimi主权益,包括Kimi Web、Kimi App和Kimi Work,将与Kimi Code权益分开。
这也表示,针对普通用户和高强度编程需求,后面可能会采用两套独立的会员体系——
毕竟,对于需要持续读写代码、调用工具和反复测试的Coding Agent来说,一次任务可能耗费很长时间,算力消耗和普通对话完全不在一个层次。
分开设置两套权益,既有助于Kimi更精确地分配算力,也为今后的会员定价和用量限制提供了调整空间~
换言之,未来「普通用户」和「算力大户」,可能需要分开使用。









