观察者网心智观察所
2025年开年之际,DeepSeek-R1横空出世。彼时,全球科技界最深处震颤并非“中国再添一款大模型”——毕竟在开源榜单上,华夏模型早已并非新客。真正颠覆固有认知的,是本土公司在美国顶级算力缺位下,用无可辩驳的事实昭示:AI能力跃升,并非仅存“GPU堆砌”这一条死路。
DeepSeek重塑了全球AI产业的成本预期。该模型发布当日,英伟达股价重挫17%,市值单日蒸发近6000亿美元,创下美股有记录以来最大单日市值跌幅。硅谷开始严肃反思:“华夏AI,或是真的觅得另一条破局之路?”
一年之后,Kimi K3的降临,宣告故事进入全新高潮。如果说DeepSeek证明华夏模型能“以极限成本紧随其后”,那么K3则标志着中国模型正式步入与全球顶尖技术“正面硬刚”的时代。
左边是Kimi的缔造者杨植麟,右边是DeepSeek的鼻祖梁文峰。
一、DeepSeek时刻:击碎美国AI的排他性叙事
长期以来,美国AI的绝对领先地位依托三大支柱:算力(英伟达GPU的垄断性统治)、资本(OpenAI与Anthropic动辄数十亿美元的巨额滋养),以及人才(全球顶级科研资源的绝对优势)。此前业界心照不宣的分野是:美国专注底层创新,华夏负责应用落地;美国构建基础模型,华夏承接商业转化。
DeepSeek率先撕开这层刻板印象。它向全球宣告:模型的上限,并非仅由GPU数量决断。算法的极致打磨、训练效能的代际跨越,以及卓越的工程实现能力,同样能释放惊人价值。2025年1月,DeepSeek-R1以远低于西方预期的成本,交出了媲美GPT-4的顶尖推理答卷。
这不仅是模型评估的胜利,更是对AI“规模定律”的颠覆性诠释。规模不再只是高算力的线性叠加,而是算法、数据与工程组织能力的乘积效应。华尔街首次陷入迷惘:若模型进阶非得依靠算力无限扩充,英伟达的算力神话能否持续?
然而,那次冲击更似远期预警。随后的半年里,微软加码AI基础设施投入,Meta将资本支出预算增20%,算力云巨头CoreWeave成功上市且股价翻倍。华尔街稍作喘息,误将DeepSeek的冲击当作一场短暂惊扰。
直至Kimi K3集中爆发。
二、K3:技术破局与战略威慑
2026年7月中旬,月之暗面正式推出旗舰模型Kimi K3。这次呈现的数据更为震撼。官方评测显示,K3在Frontend Code Arena前端代码榜斩获1679分,全面超越Claude Fable 5(1631分)与GPT-5.6 Sol(1618分)。对比上一代K2系列,K3实现了代际跨越,在七个前端细分领域中摘得六项桂冠。
行业主流券商与分析机构直言,K3乃是全球大模型行业发展的重要里程碑,意味着“华夏大模型初次以‘实质性竞争姿态’,正面进入全球顶尖模型的叙事格局”。近3万亿的参数规模、100万级旗舰上下文窗口,以及Code Arena的强势登顶,共同印证国产模型已在Agentic Coding(智能体编程)这一核心主战场,具备了与美国闭源巨头正面博弈的硬实力。
DeepSeek诞辰之际,外界多赞“华夏追及得偿所愿”;而K3问世,令硅谷的焦虑性质变:“华夏模型已然攻入核心腹地。”
核心指标一:参数规模——2.8万亿参数的巨巨之体
K3成为全球首个开源的超3万亿级超大规模大模型。参数堪称模型理解世界的“神经连结密度”,参数愈多,往往代表理解力越强、智力上限越高。过去,美企的领先优势很大程度上源于庞大的参数壁垒,而K3闯入此门槛,标志着华夏大模型彻底摆脱了“小模型微调”的局限,跻身大参数竞技场。
不过,月之暗面在官方博客中保持清醒坦率:尽管K3在部分专项与综合评测中展现全球前沿水准并力压多数对手,但在部分核心闭源长板项目上,与顶尖闭源巨头尚有微弱差距需跨越。
核心指标二:100万Token的长文本上下文窗口
100万Token的长上下文,意味着模型能瞬时处理数十篇复杂长文、庞大的代码库乃至企业级数据库。这直指未来AI Agent(智能体)的进化终极目标。真正的Agent绝非一问一答的对话机器人,它必须具备海量资料读取、深度解析、自主规划方案及多步执行能力。
官方演示中,K3仅耗时约两小时,便自主复现了计算天体物理学领域的I-Love-Q普适关系——此任务通常需资深科研人员一周以上全力投入。期间,它交叉验证了20多篇高阶学术论文,自行搭建了完整数值计算流程,评估了300余种状态方程,甚至敏锐指出了已发文献中的逻辑瑕疵,最终稳定输出3000多行高质量Python代码。
更为惊艳的是其长程自主编程能力:K3在连续48小时的无干预自主运行中,基于开源EDA工具与Nangate 45nm工艺库,独立完成面积达4mm²、集成146万个标准单元、主频100MHz的芯片构建优化与验证。全程完全规避了传统EDA双雄Cadence与Synopsys的商业软件限制。这种纯粹依靠算法智能在48小时内跑通芯片设计全链路尝试,成为对外部技术封锁的极佳回应。
核心指标三:Code Arena盲测夺魁——华夏模型的历史性突破
在Frontend Code Arena评测中,Kimi 3荣登榜首,这是华夏大模型在该公开盲测榜单中实现的历史性跨越。Arena机制依赖真实公开盲测:百万级真实开发者将同类前端任务交予两位匿名的模型处理,纯凭生成体验投票。这绝非实验室里的精心刷榜,而是全球开发者以真实生产力场景投出的信任之票。K3的领先,意味着它已在AI最核心、最具商业价值的前沿场景,具备了替代复杂工程劳动的潜力。
Vercel首席执行官Guillermo Rauch在工程评测后坦言:开放权重模型首次在前端综合工程上超越全行业专有模型。尽管榜单无法覆盖所有边缘场景,顶尖模型的任务完满率尚未达100%,但其爆发力已足够惊人。马斯克在相关分析推文下留下“Impressive”的评价;而Stability AI前创始人Emad Mostaque则更为激进地预言:“美国顶尖实验室终将转向‘蒸馏华夏模型’的路径。”
加州大学伯克利分校Ion Stoica教授此前曾断言华夏开源模型与全球顶尖水平存6至9个月代差,如今他修正看法:“此差距可能已急剧缩减至2至3个月。”
三、华尔街的投资故事线动摇
K3问世后的72小时内,美股AI产业链再遇剧烈动荡。英伟达股价显著下滑,科技股权重指数及半导体板块均承受压力,全球科技股市值三日遭蒸发超4700亿美元。
摩根大通在致客户备忘录中,直接将此事件定性为“DeepSeek 2.0时刻”,指出对技术效率逆袭的担忧正令亚洲与美国科技股同步承压。
高盛合伙人在客户电话会议中指出:“算力无休止扩张的粗放时代,或正走向终结。”高盛在内部备忘录中提出一个直指痛点的诘问:“一家无法获得顶级算力支持的中国实验室,凭什么依靠架构创新、合成数据、强化学习与精密后训练,将代差缩短至此?”当这个问题抛出,过去数年华尔街“算力即正义”的单维度信仰开始松动。规模定律的核心正在演变为算力、算法、数据与后训练(RL)的综合向量,算力不再是通往圣杯的独木桥。
此前,全球科技巨头预计2026年将投入近7000亿美元资本开支,台积电等晶圆巨头亦追加预算以应对看似无尽的芯片订单。这一切神话的前提是:模型须得无限膨胀、无限烧钱。Kimi 3用实践证明:高效率的智能未必需要等量的黄金。
连锁反应迅速扩散。部分美国模型厂商着手调整其免费层级额度和API限制策略,企业级云服务商也纷纷公开表达对巨额AI投资回报率的深层忧虑。外媒直指,华夏团队在算法与工程效率上的突围,“正在动摇美国在AI领域的绝对叙事根基”。
不过,一位冷静的行业观察家在一篇复盘文中一针见血地指出:“Kimi是一款卓越的模型。但真正撼动资本市场的,并非某款特定模型本身,而是华尔街过去三年言过其实的那套叙事。Kimi只是推倒多米诺骨牌的那只手。”
四、高阶定价:商业化的质变
在API商业化层面,K3的定价策略传递出一个意味深长的信号。Kimi官方平台将K3旗舰模型的标准API定价设为输入每百万Token 20元人民币(约合3美元),输出每百万Token 100元人民币(约合15美元)。在国内市场中,这一价格明显与普通低端、打价格战的模型拉开了代差。
这一价格体系的调整,恰恰昭示了中国AI竞争的段位跃迁:如果说DeepSeek带来极致成本效率的供给侧冲击,那么K3则是在尝试探索高端智能的商业定价权。华夏模型公司若深陷价格战,其长期估值模型将难以为继;唯有在长程代码、高阶Agent等高壁垒场景构筑绝对能力优势,商业化才能从流量拼杀的“面子”,真正转向收入质量的“里子”。
高盛分析指出,在基础简单问答场景中,API价格仍将困在微利区间;但在需深度推理与复杂智能体的智力密集型市场,Kimi 3的定价表明它正全力征战高客单价的企业级核心业务。这种行业分化将愈发显著:未来唯有能持续迭代超大模型、构建高壁垒数据飞轮、并跑通Agent商业闭环的头部公司,才能维持估值溢价。
五、大模型竞争迈入新境遇
如果说DeepSeek标志华夏AI在“极限追及”时期的登顶,那么K3的横空出世,则正式吹响了全球大模型第二阶段竞争的号角。
第一阶段(2023-2025年)的核心主旨是“能力 对照”。华夏模型竭力缩小与GPT-4、Claude及Gemini的绝对智商差距,证明华夏亦能造出大模型。但由于算力生态与顶尖资源的天然约束,追赶者常承受时间差的被动。
而在第二阶段,竞争维度升级打破单一航道。K3之后,博弈焦点不再仅仅是“哪家实验室跑分最高”,而是谁能将技术效率、产业应用速度与开发者生态做到完美均衡。
这好比当年的智能手机混战。苹果固然率先定义了时代,但终局角逐从不只决胜负于单一芯片跑分,而是定价策略、开发者生态、供应链管控与本地化场景的综合博弈。
纵观华夏开源模型对全球科技界造成的冲击,可看作三波巨浪:第一波是DeepSeek以极致低成本、高效率打破算力迷信;第二波是华夏头部厂商(如智谱等)在商业化ARR与公开盲测上屡创佳绩,验证国产模型强劲的变现与技术实力;第三波正是K3——近3万亿的庞大体量,Frontend Code Arena盲测首个登顶,并宣布于7月27日前开源完整模型权重。这是华夏开源模型首次在参数规模、前沿性能和全球开发者社群声量上,对全球第一梯队王座发起冲击。
它已从一个“廉价的替代品”,演化为全球从业者不得不提高警惕的“核心生产力利器”。
六、真正的较量方兴未艾
当然,科技铁幕的另一侧,OpenAI、Anthropic和Google绝不会作壁上观。美国的体系化优势依然牢固:在基础科学与颠覆性架构的前沿探索上,他们拥有深厚底蕴;在芯片生态上,英伟达的CUDA壁垒与谷歌TPU体系绝非短期内可被轻视;在全球开发者商业生态中,美国模型依然掌握着最大的全球流量。
月之暗面团队对自身定位同样保持清醒,深知在部分长板闭源领域,华夏大模型仍需持续精进。在实际高强度测试中,亦有部分独立开发者指出,K3在处理复杂长程推理时偶现“过度思考、自行扩展任务边界”的冗余现象。知名开源技术专家亦强调,任何开源权重的实用价值,均需交由全球开源社区经过长期、真实的生产力业务检验。
华夏模型的突破,并不代表对岸的溃败。两大科技巨头之间的真正竞逐,才初露锋芒。
华尔街真正感到忧虑的,从来不是某一单模型,而是“AI资本开支必须螺旋上升”的永续逻辑被现实击碎。一次突围可视为天才偶得或时来运转;但当不同的华夏团队,在不同节点、以截然不同的技术路径接连完成低成本智能逆袭时,全球资本就必须重置概率演算模型。
而当这个底层概率被改写,全球AI产业的浪潮,就此彻底转向。
七、尾声:追及者到破局者
回望过去十年,华夏移动互联网的辉煌很大程度上基于成熟底层技术之上,进行商业模式与应用场景的极致复制——电商、移动支付、短视频均属此类。我们享受了红利,但在底层技术层面却常处受限境地。
但在AI时代,落棋格局截然不同。
这是华夏第一次在一个关乎人类未来命脉的全球技术产业中,作为核心参与者参与行业规则与技术范式的订立。DeepSeek奋力推开了门,而K3的重磅加入则证明华夏AI模型不仅能咬住比分,更开始对全球竞争的节奏施加本属自身的引力。
未来的大模型之争,既不属于单纯堆砌最多GPU的算力暴发户,也不属于闭门造车的理想家。最终赢家,必是能将算法效力、产业生态与真实商业闭环完美融合的破局者。
从证明“自己能做”,到向世界昭示“自己能赢”,华夏大模型正以一种从容而有力的姿态,迈入属于自己的纪元。








