DeepSeek调价今日正式生效,涨幅最高达1100%,空闲时段价格为高峰的一半

来源:宁波晚报近日,深度求索官方宣布对DeepSeek API价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间9:00-12:00、14:00-18:00(其余为空闲时段)。新价格于北京时间8月17日00:00开始生效。8月12日晚,DeepSeek悄然上新DeepSeek-V4-pro正式版。当时的官方页面信息显示,V4 Pro每百万tokens输入(缓存未命中)3元、输出6元,缓存命中输入低至0.025元。最新调整后的价格方案为,高峰时间段,V4 Pro每百万tokens输入(缓存未命中)9元(涨幅200%)、输出27元(涨幅350%),缓存命中输入0.3元(涨幅1100%)。空闲时间段,V4 Pro每百万tokens输入(缓存未命中)4.5元、输出13.5元,缓存命中输入低至0.15元。以此看来,V4 Pro高峰时间段涨幅最高达1100%。(中新经纬综自公开信息、南方都市报)责任编辑:刘德宾…

DeepSeek联合北大发布DSpark框架:大模型推理速度提升60%–85%

6月27日,DeepSeek团队联合北京大学发布名为《DSpark》的研究论文(基于speculative decoding方向),提出一种用于加速大模型推理的新方法。论文指出,现有并行“草稿生成”方式虽然能一次生成更长token,但由于token间关联不足,容易导致被拒绝比例上升,并浪费验证算力。为此,DSpark引入半自回归结构,在并行生成骨干上加入轻量级顺序模块,以增强token之间的依赖关系,提高草稿质量。同时,DSpark提出“基于置信度的动态验证机制”,根据不同请求的成功概率与系统负载,自适应调整验证长度,从而减少无效计算开销。在离线测试中,该方法显著提升了可接受生成长度;在DeepSeek-V4线上系统中,相比基线模型,推理速度提升约60%–85%,并有效降低高并发下的吞吐损耗。论文同时开源模型检查点与训练框架DeepSpec,以推动社区进一步研究。责任编辑:刘德宾…

DeepSeek联合北大发布DSpark框架:大模型推理速度提升60%–85%

6月27日,DeepSeek团队联合北京大学发布名为《DSpark》的研究论文(基于speculative decoding方向),提出一种用于加速大模型推理的新方法。论文指出,现有并行“草稿生成”方式虽然能一次生成更长token,但由于token间关联不足,容易导致被拒绝比例上升,并浪费验证算力。为此,DSpark引入半自回归结构,在并行生成骨干上加入轻量级顺序模块,以增强token之间的依赖关系,提高草稿质量。同时,DSpark提出“基于置信度的动态验证机制”,根据不同请求的成功概率与系统负载,自适应调整验证长度,从而减少无效计算开销。在离线测试中,该方法显著提升了可接受生成长度;在DeepSeek-V4线上系统中,相比基线模型,推理速度提升约60%–85%,并有效降低高并发下的吞吐损耗。论文同时开源模型检查点与训练框架DeepSpec,以推动社区进一步研究。责任编辑:刘德宾…


扫描关注微信号有更多的信息,点击可缩放大小