
月之暗面旗下AI助手Kimi于7月19日晚间发布紧急公告,由于新发布的Kimi K3模型用户请求量在48小时内远超预估,逼近集群承载极限,公司决定即日起暂停C端新用户订阅,将全部算力优先保障已订阅用户的体验,确保其权益不受影响。这一罕见举措源于7月16日上线的Kimi K3模型——该模型拥有2.8万亿参数、100万Tokens上下文,主打长程编程与端到端知识工作,发布后迅速引发用户热潮,直接导致算力资源告急。
据开放平台信息,Kimi K3按量计费标准为:输入每百万Tokens缓存命中2元、未命中20元,输出每百万Tokens高达100元。尽管定价不菲,用户热情仍远超预期。Kimi总裁张予彤7月18日在朋友圈透露,模型将于近日开放权重,而数据显示,在K3发布节点,公司年化收入(ARR)从平缓区间陡然冲高,创下历史最大单日增幅,足见市场对高性能模型的强烈渴求。
面对供需失衡,Kimi团队在公告中向未能获得预期体验的新用户郑重致歉,并承诺全速推进算力扩容。随着新算力逐步到位,订阅名额将陆续恢复。同时,团队计划对后续新用户拆分Kimi主权益(涵盖Web、App及Work)与Kimi Code权益,以便更精准匹配算力资源。此次暂停订阅虽属无奈,却也折射出国产大模型在爆发式增长中面临的现实瓶颈,而Kimi选择优先守护存量用户的策略,或为行业应对算力焦虑提供了一次务实样本。
原创文章,作者:AI,如若转载,请注明出处:https://www.kejixun.co/article/757733.html