洱海新闻

3300亿!为什么是杨植麟?

来源:洱海新闻 分类:科技
3300亿!为什么是杨植麟?

01、中国大模型,拿回定价权

作者:孙欣

来源:中国企业家杂志

7月16日晚9点,距离WAIC(世界人工智能大会)开幕不足24小时,月之暗面(Kimi)突然对外发布Kimi K3,瞬间抢占了最大的焦点。

Kimi K3最具冲击力的标签,便是那2.8万亿的参数规模。作为全球首款万亿级开源大模型,K3支持高达100万Token的上下文窗口,在多项主流测评中,得分超越了GPT-5.6、Fable 5。

诸多AI行业资深从业者评论:在长模态、大上下文以及复杂任务场景方面,Kimi K3在国内形成了明显的断层式领先。

配套的定价策略同样备受关注。Kimi K3提供未缓存输入20元/百万Token、输出100元/百万Token的服务,这使其位列国产模型中最贵的一档——比DeepSeek V4 Pro贵出20倍;相比之下,它是海外模型Fable 5价格的30%、GPT-5.6 Sol的60%。

高盛在研报中明确指出:“这一举动意味着中国模型在定价上迈出了全新步伐。”

“Impressive(令人印象深刻)。”马斯克在X上为K3点赞。紧接着,他在预热Grok 4.5时直言:“这个版本有望超越Kimi。”对此,月之暗面联合企业业务负责人黄震昕于7月21日对媒体表示,对此充满期待:“静观其变,希望他们能和我们正面对决。”

K3带来的影响,在资本市场上掀起了波澜。

7月17日,英伟达、谷歌、Meta、英特尔四家科技巨头股价出现下跌。据美国媒体报道,虽然并非单一因素所致,但K3无疑是关键的催化剂之一。

香港股市方面,K3发布后第二天,智谱单日下挫28.49%,MiniMax下挫15.62%。华创证券给出的研报称,当日港股指数整体低迷,但K3发布仍是智谱和MiniMax股价波动的直接推手。

K3在海外引发的震动,也让杨植麟受到了广泛关注。

他在清华申请特等奖学金的答辩视频、在卡内基梅隆大学(CMU)读博士期间的论文迅速成为热门话题。

一位硅谷风投合伙人在X上提出质疑,相关热度高达千万条:为何这样优秀的人才,毕业后选择不留在美国?这也让杨植麟在CMU读博时的导师、苹果首任AI总监Russ Salakhutdinov亲自“下场”维护爱徒。

近日,记者联系上了Russ教授,他评价道:杨植麟表现突出,在不足4年时间里就成功获得博士学位,这在CMU极为罕见。

“植麟是CMU最出色的学生之一,他深谙研究问题,掌握高超技术,还能进行底层编程——这些能力通常是分开的,很少发现这样全面的学生。”

Russ表示,杨植麟在博士期间的研究成果十分优异,完成了大量基础性的机器学习课题,其XLNet(一种广义自回归预训练模型)、Transformer-XL(一种超长上下文语言模型)方向的论文,已变成AI模型理论体系的重要组成部分。

杨植麟毕业时,众多公司向他伸出橄榄枝。Russ追忆,他本有机会去MIT、普林斯顿任教,但杨植麟第一时间坚持回国创业。“对于植麟这样的水准,通常会选择学术道路,而创业风险高,但他在商业与研究两方面都非常出色。”

尽管Kimi K3的实力获得了行业认可,但高昂的调用费用也引发了诸多讨论。

“价格昂贵主要因为Token使用量大,Agent处理长任务的成本高。”AI系统研发工程师李佳龙指出。AI英语训练产品公司TalkMe的创始人贾子健举例:“粗略估算,部署DeepSeek V4 Pro,大概需要8张H100或者A100显卡,但在相似情况下运行K3,则可能需要20张H100。”

面对这些声音,黄震昕回应:“开源的模型、国产大模型不该被廉价的标签绑定,我们打造了SOTA级模型,在商业上也需要与之匹配的定价。”

庞大的参数,同时也影响着K3的运行效率和交付进度。李佳龙提到:K3处理复杂任务时,一个完整的编程任务往往需要超过30分钟。贾子健

相关推荐