DeepSeek 把缓存打到 2 分钱

📅 2026-09-11 🖼 5 张贴图 ⏱ 2 分钟
01
01

DeepSeek 新模型上线

正式版上线,换了新架构、原生多模态,价格却比上一代更低。

1M
超长上下文
原生
多模态视觉
300+
tokens/秒
更快、更强,却更便宜——这次是真降
它顶的是上一代旗舰的流量位:用 Flash 的价格,吃 Pro 的活。
02
02

缓存命中 只要 2 分钱

空闲时段每百万 token:缓存命中 0.02 元、输入 1 元、输出 4 元,高峰翻倍。

0.02元
缓存命中
1元
输入
4元
输出
省的不是零头,是 Agent 的大头
Agent 任务里缓存命中的调用占比最高,降价打中的正是最烧钱的那一段。
03
03

WorkBuddy 打到 0.03 倍

国内版全量接入这个新模型,两周内积分消耗按 0.03 倍计,约等于免费。

0.03倍
积分消耗
两周
限时窗口
⚠️
不可导API
便宜是真的,锁在客户端里也是真的
折扣只给产品内额度、不给独立 API:平台用补贴换留存,不是送算力。
04
04

杭州程序员 年卡 693 元

智谱联合杭州及上城区推 Coding 补贴,在杭工作者与大学生最高减免 51%。

51%
最高减免
693.84元
Lite年卡
44%
季卡档
城市为抢开发者,先把价格打下来
补贴绑定的是生态位:先用低价把本地开发者锁进自己的编码工作流。
05
05

超维动力 拿了 5 个亿

成立 11 个月的全栈具身智能公司完成超 5 亿元天使+轮,淡马锡旗下机构参投。

5亿+
天使+轮
11个月
成立时长
具身
全栈大模型
资本押的不是模型,是机器人的手感
天使轮就给 5 亿,投的是「数据-模型-本体」闭环能否跑通,而非单点技术。
2026-09-11,AI 圈的关键词是"降价"和"补贴"。DeepSeek 正式版 V4.1 Flash 上线,把每百万 token 的缓存命中价打到 0.02 元、输入 1 元、输出 4 元,还将在 09-14 下线上一代 V4 Pro、由它接管流量;腾讯 WorkBuddy 国内版同步全量接入,给出两周内积分消耗 0.03 倍的限时折扣,约等于免费,但只限客户端内、不可导出 API。智谱把补贴做到城市级:联合杭州及上城区推出全城 Coding 计划,在杭工作者与大学生买 GLM Coding 套餐最高减免 51%,Lite 年卡低至 693.84 元。资本端同样热闹,成立仅 11 个月的具身智能公司超维动力宣布完成超 5 亿元天使+轮系列融资,淡马锡旗下祥峰资本等参投。一句话:模型能力趋同之后,下一轮竞争比的是谁能把价格和使用门槛压得更低。