Menu

月之暗面再回应马斯克喊话:希望能出来“掰掰手腕”

图片来源:视觉中国 界面新闻记者 | 宋...
网络新闻 2 小时 之前

图片来源:视觉中国

界面新闻记者 | 宋佳楠

马斯克与月之暗面的隔空对话又有新内容。

7月21日,据21世纪经济报道消息,月之暗面企业业务负责人黄震昕在谈及马斯克称“Grok 4.6会很快超过Kimi”时表示,“可能这次(K3)的这个表现,(让他们)得到一点震撼的感觉,现在拭目以待,希望他们出来跟我们掰一掰手腕。”

据黄震昕介绍,他们与马斯克并没有直接认识,但双方互动非常频繁。对于能得到马斯克这一同行的肯定,黄震昕用“挺珍贵”来形容。

这不是马斯克第一次注意到这家中国公司。今年3月,月之暗面发布《Attention Residuals》论文,提出“注意力残差”机制以替代传统Transformer架构中的残差连接。马斯克在社交平台转发并评论:“Kimi的工作令人印象深刻(Kimi’s work is impressive)。”当时,月之暗面官方幽默回应:“你的火箭造得也不错!”

时隔四个月,月之暗面于7月17日正式推出Kimi K3。这款2.8万亿参数混合专家模型并没有配套的发布会,但很快引发行业热议。马斯克第一时间在相关评测报道评论区留下“Impressive”简短评价,再次对月之暗面的技术能力表达肯定。

与此同时,马斯克主动披露了Grok 4.6的相关情况。“我们的2万亿参数模型,在各方面都优于我们1.5万亿参数模型,将于下周完成初步训练。它有可能超越Kimi,不过推理速度与Token效率接近我们1.5万亿版本(即Grok 4.5)。”此举被外界视为马斯克主动向Kimi抛出竞争邀约。

对此,月之暗面官方微博回应称,“欢迎加入‘2万亿+’俱乐部”。

之所以马斯克会将Kimi视作核心对标对象,与Kimi K3的技术能力直接挂钩。据月之暗面介绍,Kimi K3采用自研KDA混合线性注意力机制与注意力残差技术,设置896个独立专家模块,单次推理仅激活16个单元,算力使用效率较前代提升2.5倍。

其原生支持100万token超长上下文与多模态视觉理解,在代码生成、复杂逻辑推理、批量文档处理、智能体执行等核心任务评测中表现突出。例如在Frontend Code Arena编程基准测试中,Kimi K3以1679分超越Anthropic的Claude Fable 5和OpenAI的GPT-5.6 Sol。

月之暗面计划于7月27日完整开源K3模型权重,面向全球开发者开放商用权限。API定价为输入每百万token 3美元、输出每百万token 15美元,虽较前代上涨,但相比闭源旗舰仍具成本优势。

中信建投发布的最新研报指出,Kimi K3是全球首款近3万亿参数开源大模型,标志着国产大模型正加速缩小与海外前沿模型的差距,并由单纯参数扩张转向模型能力、推理效率和应用落地的全面突破。随着国产模型持续迭代、用户调用量和推理需求快速增长,国内算力基础设施有望迎来新一轮扩容,建议重点关注国产大模型厂商,以及国产算力产业链投资机会。

值得一提的是,Kimi K3发布后,用户请求量超出月之暗面的预估。为此,该公司于7月20日发布关于算力紧缺与会员暂停开放的说明,称即日起暂停C端新用户订阅,将已有算力全部投入于服务已订阅用户,保障已订阅用户的全部权益不受影响。

月之暗面表示,其已在全速推进算力扩容。随着新算力陆续到位,将逐步开放更多订阅名额直至全面恢复正常订阅。对于后续新订阅用户,该公司将拆分Kimi主权益(包含Kimi Web,Kimi APP,Kimi Work)和Kimi Code权益,以方便更精准匹配算力,保障用户体验。

今年6月,黄震昕曾向包括界面新闻在内的媒体透露,Kimi B端业务占比正在持续提升,互联网、金融、制造、教育、医疗等行业,都已成为公司重要企业客户来源,海外业务同时也在快速增长。

黄震昕还反复强调,公司的核心仍然是对模型底层创新的投入,包括继续推动模型架构演进,以及坚持探索Scaling Law的边界。

目前月之暗面处于国内大模型创业公司第一梯队。该公司成立仅两个月便完成近20亿元天使轮融资,红杉中国、真格基金等头部机构入局。2024年2月,月之暗面完成超10亿美元融资,估值达25亿美元;同年8月再获超3亿美元,估值升至33亿美元。2025年12月,其又完成5亿美元C轮融资,估值43亿美元,账面现金超100亿元人民币。

今年前两个月,公司连续完成5亿、7亿、7亿美元三轮融资,估值从100亿美元攀升至180亿美元,阿里、腾讯、五源资本等老股东持续加码。算上5月完成的新一轮20亿美元融资,Kimi累计融资额已超376亿元,成为国内大模型创业公司中累计融资最多的公司。作为对比,MiniMax累计融资约150亿元,智谱约130亿元。市场消息称公司正洽谈Pre-IPO轮融资,计划最快六个月赴港上市。

尽管Kimi K3收获外界肯定,但在多模态深度理解、超长复杂智能体闭环、底层算力生态适配层面,仍与GPT、Claude系列存在差距。黄震昕也表示,公司长期目标是“探索智能的上限,希望能和海外那三家模型公司掰掰手腕”。

声明:转载此文是出于传递更多信息之目的。若有来源标注错误或侵犯了您的合法权益,请作者持权属证明与本网联系,我们将及时更正、删除,谢谢

           – 推广 –