众力资讯网

DeepSeek正式启用API峰谷定价 同步推出开源Harness开发者预览版

DeepSeek正式启用API峰谷定价 同步推出开源Harness开发者预览版
近期DeepSeek一口气发布了两项面向开发者的重磅更新,不少正在跑AI项目的技术团队第一时间就注意到了新规里的成本优化空间,以及全新开源框架带来的开发便利。本文会把峰谷定价的完整规则、实操省钱技巧,还有新发布的Harness框架核心特性全部梳理清楚,帮大家快速吃透新规,合理控制API调用成本,同时上手体验全新的Agent开发工具。
这次更新首先落地的是DeepSeek V4 Pro正式版,APP、网页端和API全平台同步完成更新,API的模型名称保持不变,最核心的变化就是引入了行业内少见的峰谷差异化定价策略。按照北京时间划分,高峰时段为每日上午9点到12点、下午14点到18点,这7个小时是绝大多数企业业务开发、实时对话调用的集中时段,算力负载最高,按高峰标准价格计费;其余所有时段,包括午休12点到14点、晚间18点之后到次日上午9点,以及周末、法定节假日全天,都属于空闲时段,价格直接为高峰时段的一半。整套新的定价规则将于北京时间8月17日0点正式生效,在此之前的调用依然沿用原有计费标准。
这套峰谷定价机制本质上是用市场化的价格杠杆调配算力资源,既避免了高峰时段大量请求集中涌入导致的排队、卡顿问题,也能让闲时的闲置算力得到充分利用,开发者只要合理调整任务调度逻辑,就能直接省下一半甚至更多的调用成本。大家可以先梳理自己团队的API调用账单,把所有非实时的离线任务全部挪到半价时段运行,比如历史数据清洗打标、批量内容生成、自动运营报表生成、非紧急的数据挖掘任务,这些任务不需要秒级响应,错峰运行不仅成本砍半,闲时算力充足,运行速度反而更快。
对于必须在高峰时段运行的实时业务,也有不少低成本优化的方法,最见效的就是提升输入缓存的命中率。缓存命中的场景下,重复的系统提示词、固定对话上下文不需要重新运算,算力消耗极低,计费价格比缓存未命中低上百倍,只要做好多轮对话的前缀缓存,把常用的固定提示词固化下来,就能把高峰时段的调用成本大幅压缩。再搭配高低模型分流的策略,简单的轻量问答、常规编程需求用性价比更高的V4 Flash模型处理,只有复杂的长流程Agent任务才调用旗舰V4 Pro模型,整套组合拳下来,大部分团队的API调用成本都能降低六成以上。

就在发布峰谷定价规则的同一天晚间,DeepSeek还正式推出了DeepSeek Harness V0.1开发者预览版,面向全球开发者开放测试,并且以MIT协议正式开源。这款框架最核心的设计理念是“一切皆插件”,所有Agent运行需要的核心能力,包括模型调用、工具调用、技能封装、绘画能力、沙箱环境、数据存储、运行循环、调度逻辑甚至UI界面,全部都以插件的形式实现。
它底层依托名为Cordis的插件系统运行,开发者不需要改动框架的底层源码,只需要在配置层做调整,就能自由组合、替换、扩展所有的Agent能力,灵活度非常高。官方还针对不同的使用场景提前预置了四种默认模式,分别是标准模式、PTC模式、极简模式以及创造模式,开发者可以直接选用适配自己场景的模式快速启动开发,目前已经有不少第三方开发者贡献了各类插件,生态正在快速完善。
官方也明确说明,当前Harness还处于早期预览阶段,功能和体验上还有不少待完善的地方,也正在邀请全球开发者一同参与共建,丰富插件生态。这次同步推出的两项更新,一边通过分时定价引导算力资源更高效地流转,帮开发者控制运行成本,一边通过完全开源的高灵活度Agent框架降低开发门槛,对于整个AI应用开发生态来说,都是非常有实用价值的新选择。