英伟达业绩炸了股市也涨了,但模型却在密集降价

文 | AI 情报站 · 2026 年 8 月 27 日

昨晚英伟达交出的那份财报,超预期基本在所有人预料之中。数字好看,股市也给了反应,跟着涨了一波。但有意思的是,就在同一片天空下,美国那几家大模型公司又开始密集降价了。一边是卖铲子的把账做得分外漂亮、资本用脚投票确认景气;另一边是挖金子的为了抢用户,把 API 价格一压再压。这两件事同时发生,初看矛盾,细想却恰好把 AI 产业链上钱的流向说清楚了。

我把它们读成了一件事:英伟达赚的是“AI 投入确定性”的钱,而模型公司贴的是“还没到收割期”的本。一个在兑现当下的景气,一个在赌未来的份额。这两条线拧在一起,对咱们这些天天用 AI、调 API、比价格的人,其实是个挺明确的信号。

英伟达的超预期,到底确认了什么

先说财报这一侧。超预期本身不算意外,圈子里不少人提前就押了——我们前天那篇讲自研芯片的文章里,把昨晚的财报叫做“第一块试金石”,判断大概率是漂亮成绩单。原因当时写过:自研芯片从立项到成规模替代是以年计的,而眼前的训练需求还在疯涨,Google、Amazon、Microsoft 一边喊自研,一边照样是英伟达最大的买家,因为自家芯片根本不够用。

所以这份超预期的财报,确认的不是“英伟达永远无敌”,而是确认了一件事:AI 基建的投入周期还远没到头。大厂砸钱 All-in AI 不是嘴上说说,是真金白银在买卡、建数据中心。股市涨,涨的就是这个“确定性”——只要大家还相信 AI 要继续烧钱扩建,英伟达的订单就还在。

但有个细节值得咂摸:英伟达越强,越说明算力这个环节短期内还是卖方市场。它手里捏着 GPU、网络、软件栈一整套,别人想绕开没那么快。这意味着一件事——算力成本,尤其是高端训练算力,短期很难掉下来。你指望英伟达因为业绩好就给你降价,那是不存在的,它越被需要,议价权越在它手里。

模型公司为什么要逆着降价

再看另一头。美国大模型公司密集降价,这股风从 8 月中旬就开始吹了:GPT-5.6 的轻量档砍过、旗舰 Sol 后来也降了两成多,谷歌 Gemini Flash 直接对半砍。现在新一轮又来,说明这不是一次性的促销,而是常态化的价格战。

为什么模型公司要在英伟达赚得盆满钵满的时候自己降价?逻辑其实反着来:正因为底层算力贵、建模型烧钱,它们才更要抢用户。模型这东西,用户用得越多、数据越多、生态越黏,长期价值越大。现在大家都没到稳定收割的阶段,谁先圈住开发者、圈住调用量,谁就握住了下一轮议价的筹码。降价是最直接的圈人手段——你每个月 API 账单少两成,很难不心动,更难不把更多业务迁过来。

这里还有个被忽略的推手:开源与低价模型的渗透。海外的 ox alpha 最近被确认就是智谱的 GLM-5.3 flash——一个匿名刷榜的“海外模型”,剥开皮是国产模型在撑腰。这类高性价比模型在国际开发者社区里持续渗透,逼着闭源大厂重新算账。与其让用户被平替吸走,不如自己先降,把人留在自己的生态里。所以你看到的“降价”,底层是“防守性圈地”,而国产 flash 模型已经悄悄坐到了牌桌上。

两条线拧起来,对用 AI 的人意味着什么

把这两件事放在一起,钱的流向就很清楚了:资本和利润往上走,堆在算力基建这一层(英伟达是其中最肥的那块);而应用和服务这一层,正在用降价把利润让出来换份额。对你来说,这不是一个该观望的信号,而是一个该顺势利用的窗口。

第一,趁模型降价,把能迁的 API 都迁到便宜的那家。GPT Sol 降了、Gemini Flash 半价了,你的 token 账单现在就是实打实比以前低。但记住前面反复提醒的:别把业务写死在一家接口上。降价是动态的,今天这家便宜明天那家更便宜,搭个模型路由层、保持可切换,才能一直吃到最低价。

第二,别急着自己建算力。英伟达业绩确认了算力还是卖方市场,高端 GPU 和训练集群短期不会便宜。对个人和小团队,自己攒卡训模型的经济账越来越不划算——同样一笔钱,用来买降价的 API 能跑出多得多的量。除非你的场景对数据隐私或延迟有硬要求,否则“用别人的算力、调便宜的模型”在接下来一两年都是性价比最高的打法。

第三,把股市的狂欢当成一个观察指标,而不是入场信号。英伟达涨,说明 AI 基建景气被资本确认;模型降价,说明应用层还在跑马圈地。这两个信号同时成立,意味着我们处在“基建已热、应用未收”的阶段。对你做产品、做选型的影响很直接:上游贵且稳,下游便宜且卷,那就尽量待在下游用别人的便宜能力,别往上游客场去拼。

卖铲子的赚走了确定的钱,挖金子的贴出了抢人的本。这条链路上利润落在哪一层,决定了你该站在哪一层——眼下最划算的位置,是拿着降价的铲子、借别人的矿。