DeepSeek 把缓存打到 2 分钱
📅 2026-09-11
🖼 5 张贴图
⏱ 2 分钟
01
01
DeepSeek 新模型上线
正式版上线,换了新架构、原生多模态,价格却比上一代更低。
更快、更强,却更便宜——这次是真降
它顶的是上一代旗舰的流量位:用 Flash 的价格,吃 Pro 的活。
www.airedirector.com
02
02
缓存命中 只要 2 分钱
空闲时段每百万 token:缓存命中 0.02 元、输入 1 元、输出 4 元,高峰翻倍。
省的不是零头,是 Agent 的大头
Agent 任务里缓存命中的调用占比最高,降价打中的正是最烧钱的那一段。
www.airedirector.com
03
03
WorkBuddy 打到 0.03 倍
国内版全量接入这个新模型,两周内积分消耗按 0.03 倍计,约等于免费。
便宜是真的,锁在客户端里也是真的
折扣只给产品内额度、不给独立 API:平台用补贴换留存,不是送算力。
www.airedirector.com
04
04
杭州程序员 年卡 693 元
智谱联合杭州及上城区推 Coding 补贴,在杭工作者与大学生最高减免 51%。
城市为抢开发者,先把价格打下来
补贴绑定的是生态位:先用低价把本地开发者锁进自己的编码工作流。
www.airedirector.com
05
05
超维动力 拿了 5 个亿
成立 11 个月的全栈具身智能公司完成超 5 亿元天使+轮,淡马锡旗下机构参投。
资本押的不是模型,是机器人的手感
天使轮就给 5 亿,投的是「数据-模型-本体」闭环能否跑通,而非单点技术。
www.airedirector.com
2026-09-11,AI 圈的关键词是"降价"和"补贴"。DeepSeek 正式版 V4.1 Flash 上线,把每百万 token 的缓存命中价打到 0.02 元、输入 1 元、输出 4 元,还将在 09-14 下线上一代 V4 Pro、由它接管流量;腾讯 WorkBuddy 国内版同步全量接入,给出两周内积分消耗 0.03 倍的限时折扣,约等于免费,但只限客户端内、不可导出 API。智谱把补贴做到城市级:联合杭州及上城区推出全城 Coding 计划,在杭工作者与大学生买 GLM Coding 套餐最高减免 51%,Lite 年卡低至 693.84 元。资本端同样热闹,成立仅 11 个月的具身智能公司超维动力宣布完成超 5 亿元天使+轮系列融资,淡马锡旗下祥峰资本等参投。一句话:模型能力趋同之后,下一轮竞争比的是谁能把价格和使用门槛压得更低。