财经

狂飙到全球第三,马斯克都要服气,可能影响很多饭碗

来源:丹巴新文网
狂飙到全球第三,马斯克都要服气,可能影响很多饭碗

岗位真正被淘汰的,往往不是岗位本身,而是“不会用AI完成这部分工作的人”。

文/今纶

这一段时间,可以说成了“Kimi时间”。要是你的公司跟月之暗面公司(Kimi)有合作,那公司就会水涨船高;但如果你不幸和它是对手,可能就要面对股市的暴跌了。

原因在于,月之暗面推出了全球第三、开源类别里的第一的模型——Kimi K3。

这东西,连马斯克都要佩服。

到底发生了什么?可能很多人对Kimi K3不太了解,对大模型到底有什么作用也不太清楚。

今天,咱们就用大白话,把这些一次性说明白。

01 马斯克的留言很特别

先来说点刺激的:

7月20日,中国软件国际在午后直线拉升,到了13:05的时候,已经飙涨了超35%。消息面上,该公司与月之暗面正式签署了“登月计划”之Token分成及联合创新合作协议。

这是一条正面的重大消息。

还有一条负面的消息,可以说是“辣椒油”级别的:

智谱在7月17日暴跌(跌幅达到了28.49%,市值蒸发超过2000亿港元),因为它的产品与Kimi(月之暗面)发布的Kimi K3模型存在直接的“竞争替代”与“情绪冲击”关系。不过,专业人士分析,智谱的暴跌是“Kimi冲击、估值泡沫破裂、筹码结构变化”等多重因素叠加的结果,并非单一原因造成的。

回顾一下旧闻:7月17日凌晨,月之暗面正式发布了迄今最强的模型Kimi K3,总参数达到了2.8万亿,成为了全球最大的开源模型。

这个Kimi K3到底是个什么东西?有点像是行业里的“核武器”。

没错,连马斯克都佩服。

首先,我还是得不厌其烦地讲讲大模型。所谓大模型,就是一种用海量文本训练出来的超大规模人工智能程序,核心能力是根据已有内容,预测接下来最可能出现的字、词或符号。

你可以把它理解为一个“读过人类几乎所有书,但只会接着往下写的超级打字员”。

Kimi K3出来之后,马斯克在相关测试的评论区留言说:令人印象深刻。

仅仅一天后,他就把Kimi当作了新的目标。马斯克在X上发布推文,宣布SpaceXAI下一代2T模型,将在下周完成初始训练。紧接着,他说这个新模型可能超越Kimi。

他说自己的产品可能超越Kimi,说明他对Kimi K3是服气、认可的,因为成了他的对标。

02 不用堆算力,AI性能就上来了

Kimi K3到底有什么用?能干啥?

简单说几个功能:它曾在连续48小时的自主运行中,独立完成了一款芯片的构建、优化与验证全流程。

它在3D场景渲染和小游戏开发方面表现得特别出色,能直接将概念转化为可玩的交互体验。

在处理超长文档(如《三体》全集)、自动写周报,以及需要高审美直觉的3D/视觉设计任务中表现也相当惊艳。

▲3D开放世界游戏 图源:月之黑暗面Kimi公众号

在某前端代码竞技场榜单中,Kimi K3位列全球第一。它不仅能写代码,还能通过截图自测并修复页面视觉问题,实现从生成到交付的跨越。

尽管在编程等垂直领域表现得非常出色,但在通用场景的综合能力上仍略逊于Claude Fable5和GPT-5.6Sol等顶尖闭源模型,全球第三是名副其实的。

它是怎么做到这么优秀的?

首先是开源,模型共设了896个专家,每次推理仅激活其中16个,有效控制了推理成本。

注意力机制方面,运用了独特的技术和架构,优化了长序列信息流动。

从SFT阶段开始应用了量化感知训练,使用了MXFP4权重与MXFP8激活值,提升了硬件兼容性。

Kimi K3干的事儿就是:不用堆算力,AI的性能也上来了,因此引发市场对AI算力需求增速放缓的担忧,导致英伟达等AI芯片股在短期内出现大幅下跌和估值承压。

Kimi K3证明了通过算法创新(如MoE架构、KDA机制)和工程优化,可以用更少的算力达到顶级模型性能,动摇了英伟达“算力无限需求”的估值逻辑,压缩了高端GPU的溢价空间。

有点像是釜底抽薪的意思。

相关推荐

网友评论

登录后发表评论
暂无评论,抢沙发吧~