Echo's blog
Echo's blog
· 1 min read · 资讯

K3发布48小时:服务器满载,英伟达暴跌,硅谷连夜改策略

周六凌晨,Kimi 官方突然挂出暂停会员订阅的公告。原因很简单:K3 模型发布不到 48 小时,服务器就被蜂拥而至的用户挤爆了。一颗投入 AI 战场的深水炸弹,让华尔街和硅谷同时感受到了强烈的震感。

illus_20260721_2_1

K3 引爆服务器,Kimi 紧急刹车#

K3 的冲击力远超预期。Kimi 团队不得不暂停新用户订阅来争取扩容时间,这在 AI 行业极为罕见。即便如此,资本市场已经用脚投票。Kimi 正在完成新一轮融资,估值突破 300 亿美元,最快 6 个月冲击 IPO。从 3 月到 6 月,Kimi 的 ARR 从 1 亿美元飙升至近 3 亿美元,三个月翻了三倍。更值得注意的是收入结构的巨变:API 业务占比突破了 70%,这意味着 K3 正在成为企业级 AI 基础设施的核心选择,不再只是 C 端聊天工具。

illus_20260721_2_2

英伟达一夜蒸发 1111 亿美元#

K3 引发的恐慌迅速传导到芯片市场。英伟达单日市值蒸发约 1111 亿美元,费城半导体指数暴跌 12.5%,创下 15 个月来最差单周表现。摩根大通直接将 K3 称作 DeepSeek 2.0,认为开源模型体系正在从根本上改变 GPU 需求格局。美国前 AI 事务负责人 David Sacks 公开发文警告,这是中国模型第一次在前端编程赛道拿下第一,照此以往美国将输掉 AI 竞赛。英伟达股价的剧烈震荡反映出资本市场的深层焦虑:更高效的开源模型意味着市场对高端算力的单一依赖正在松动。

illus_20260721_2_3

视觉闭环让模型自己看自己#

K3 的核心突破在于 RL Scaling 加视觉闭环。它从 2024 年的 K0-Math 演进而来,当时的思路是让模型自己刷题、自己改错,把解题经验内化成能力。如今这套逻辑被扩展到了全场景:模型写完代码,自己看效果,哪里不对自己改,改完再看,形成生成、观察、迭代的完整工作流。K3 甚至从零写出了一个基于 Three.js 和 WebGPU 的 3D 开放世界游戏,还能自己调用外部工具生成 3D 骑手模型。伯克利教授 Ion Stoica 分析指出,开源模型与最先进模型的差距已经从 6 到 9 个月缩小到仅 2 到 3 个月。K3 的发布节奏印证了这一点:当开源社区站在 RL Scaling 的肩膀上,整个行业的技术周期正在被大幅压缩。

来源:36 氪 /TechCrunch

Related Posts

Comments

Copied
Copied to clipboard