“我们拭目以待,欢迎大家一起掰一掰手腕。他有信心,我们有更强的信心。”7月21日,最近因新模型火爆全球的北京大模型企业月之暗面相关负责人回应了特斯拉CEO马斯克“可能超越Kimi”的言论。
近日,月之暗面发布新一代开源大模型Kimi K3,马斯克在相关评测报道下留言“令人印象深刻(Impressive)”, 不过随后他称自己AI公司正在训练的新模型“可能超越Kimi”。面对马斯克的隔空“宣战”,月之暗面微博账号 “月之暗面 Kimi”当时直接@ElonMusk,并发文称:欢迎加入2万亿+俱乐部。
“另一个DeepSeek时刻”
7月17日凌晨,月之暗面正式发布新一代大模型Kimi K3。该模型参数规模达2.8万亿,拥有100万token上下文窗口,原生支持视觉理解。月之暗面称其为“迄今能力最强的模型”。
多款海外AI评测榜单数据显示,Kimi K3在代码生成、长文本逻辑推理、多文档处理等测试项目中排名靠前。据悉,Kimi K3搭载自研KDA注意力算法,拥有896个独立专家模块,单次计算激活16个单元,算力使用效率较前代产品提升2.5倍。 该公司计划于7月27日完整开源Kimi K3模型权重,面向全球开发者开放商用权限。
一款国产大模型因需求过载而主动限流,这在国内AI行业中实属罕见。 中信建投将此定义为“另一个DeepSeek时刻”,称中国大模型第一次以竞争威胁身份进入全球叙事。
在资本端,据市场消息,月之暗面已启动港股IPO筹备,投前估值315亿美元。其ARR(年度经常性收入)从4月的2亿美元增长至6月的3亿美元,为这一估值提供了商业化支撑。
依据月之暗面开放平台公示标准,Kimi K3输入定价为20元/百万tokens(缓存未命中)、2元/百万tokens(缓存命中),输出定价为100元/百万tokens。横向对比来看,Kimi K3的输出价格远超DeepSeekV4-Pro、小米MiMoV2、智谱GLM-5.2以及Qwen3.7-Max。
引人关注的是,Kimi K3发布当日, 马斯克在相关报道评论区留言,用“令人印象深刻”的字眼来评价该模型。
这是今年以来马斯克第二次公开肯定Kimi团队技术能力。3月,月之暗面发布《Attention Residuals》论文,当时马斯克在X平台转发该论文并评论:“Kimi的工作令人印象深刻”。随后,月之暗面Kimi以一句“你的火箭造得也不错!”幽默回应。这场隔空互动被外界视为是顶尖技术者的惺惺相惜,同时也开启了后续双方的良性互动。
马斯克隔空“宣战”
不过,这次刚对Kimi K3表达赞赏不久,马斯克就开始“放狠话”,展示自己旗下产品的竞争力。
7月18日,马斯克在社交平台X披露xAI研发计划,称当前正训练参数规模达2万亿的Grok 4.6大模型,计划一周内完成首轮完整训练,新版本性能相较1.5万亿参数的Grok 4.5实现升级。 引人关注的是,马斯克在文中提及该模型有望实现对Kimi的性能超越。
据悉,马斯克2023年成立AI企业xAI,团队成员主要来自OpenAI、Google DeepMind、Meta等机构,核心产品Grok系列大模型同步启动研发,产品深度联动X社交平台、特斯拉、SpaceX生态。
2024年3月,xAI推出Grok-1,参数规模为3140亿,遵循 Apache2.0协议开源完整模型权重;同月迭代Grok-1.5,将上下文窗口拓展至128K Token,长文本推理能力优化;4月发布Grok-1.5V,新增图像视觉处理能力。同年8月,多模态版本Grok 2上线,同步推出轻量化Grok 2 mini,覆盖通用对话、代码编写、图文分析场景,同期xAI自建 Colossus 超算集群投入模型训练。
2025年2月,xAI发布Grok 3,依托10万块英伟达H100芯片算力完成训练,推理、多模态综合性能大幅提升;7月推出Grok 4,分为标准版与Grok 4 Heavy多智能体版本,最高支持256K上下文窗口,新增多音色语音交互、视频基础解析能力。原规划的Grok 3.5版本后续取消研发计划,技术路线并入Grok 4系列迭代体系。
2026年,Grok进入万亿参数模型研发阶段。5月,xAI完成1.5万亿参数V9-Medium基座模型训练,训练过程导入代码工具Cursor行业数据,侧重于工程编程场景优化;6月28日,基于该基座打造的Grok 4.5启动特斯拉、SpaceX内部封闭测试,并于7月8日面向开发者与付费用户全面开放API调用服务。
公开资料显示,月之暗面2023年在北京成立,CEO杨植麟是清华本科、卡内基梅隆博士,Transformer-XL和XLNet的核心作者之一,曾在谷歌、Meta的AI实验室深耕。公司先后获得阿里、腾讯、红杉中国等机构投资。
在业内人士看来,此次“隔空喊话”折射出全球AI行业竞争格局的发展转变。最初全球大模型技术对标基准长期由OpenAI、Anthropic等硅谷企业主导,近两年 DeepSeek、GLM、Kimi等国产大模型持续更新迭代,已站上全球技术竞争的核心舞台。
你看好哪个大模型?评论区说说~