塔斯娱乐资讯网

V4 Pro 退场,先看价格 DeepSeek 开放平台发的通知,V4.1 Flash 预计 9 月 10 日前后上线,性能、费用、速度、总用时全面超 V4 Pro。全面超过这四个字最近出现的频率有点高。先跳过,往下看价格。数字比形容词靠谱。 新价格 9 月 10 日 12 点生效。空闲时段,输入缓存命中每百万 token 0.02 元,缓存 ​

V4 Pro 退场,先看价格

DeepSeek 开放平台发的通知,V4.1 Flash 预计 9 月 10 日前后上线,性能、费用、速度、总用时全面超 V4 Pro。全面超过这四个字最近出现的频率有点高。先跳过,往下看价格。数字比形容词靠谱。

新价格 9 月 10 日 12 点生效。空闲时段,输入缓存命中每百万 token 0.02 元,缓存没命中 1 元,输出 4 元,高峰时段全部翻倍。拿一个常见场景算:100 万 token 输入,100 万 token 输出,不走缓存,空闲时段 1 加 4,5 块钱。同样的量放高峰是 10 块。输入缓存命中 0.02 元基本是象征性的,多轮对话、Agent 这类长上下文的场景,前缀大量复用的话,成本能压得很低。反过来也说明新架构对 KV Cache 的用法有调整,不然不敢定这个价。输出 4 块这个档位,配上通知里那个性能描述,放在当前 API 定价里不算贵。

V4 Pro 的处理方式有点意思。不是直接下架,是把请求全部路由到 V4.1 Flash,按 Flash 单价计费。不对,应该说 V4 Pro 暂时还没消失,只是新的请求全被转过去了。过渡期到 V4.1 Pro 上线为止。接口没变,代码一行不用改,但底下的模型换了,输出里返回的模型名大概率会变,日志和用量统计得重新对一遍。用户这边是付更少的钱,用上更强的模型。先按新价格跑几天,看数据再说话。

话说回来,从本地部署的角度看,这件事还有一层。Flash 这个后缀,向来是轻量、快速、便宜的定位,现在它反过来把 Pro 顶掉了。云端的产品迭代跟本地跑模型是两条路。API 用户在乎单价和速度,本地部署的人在乎显存和量化,两边各算各的账。通知里顺带提了新模型原生支持多模态。多模态一旦往本地铺,显存和量化又是另一道坎。不过那是后面的事,等 V4.1 Pro 出来,两条产品线怎么摆,到时候才看得出来。

9 月 10 日 12 点价格生效,今天 9 月 11 日,正好过了一天。价格有没有按表格走,路由稳不稳定,过几天就有定论了。这种切换期的问题一般出在量上,小流量测试看不出什么,峰值一冲才知道。