Yady API
DeepSeek 峰谷计费新规:周末全天半价,这样排任务立省 50%

DeepSeek 峰谷计费新规:周末全天半价,这样排任务立省 50%

次阅读

浏览、点赞、踩均为真实统计:同一访客对同一篇文章每天只计一次浏览,点赞与踩一人一票,可改票也可撤回。

← 返回技术博客

2026 年 8 月 17 日,DeepSeek 正式启用峰谷分时计价;更关键的是,8 月 23 日起,周六、周日与法定节假日全天按空闲(低谷)价格计费——也就是直接打五折。这条规则对靠 API 跑批处理、做 Agent、搞内容审核的团队是实打实的利好:把非紧急任务挪到晚上、凌晨或周末,账单直接砍半。

配图 1
配图 1

这篇文章不灌概念,直接给你一张价差表 + 一套可落地的错峰打法。所有示例都基于 Yady API(yczc.top)——走火山引擎官方同源渠道,价格按官方价 1.27× 透明倍率,不降级、不掺水、数据不出境。错峰省下的钱来自官方定价规则,Yady 如实传导,不做任何"暗箱"。

如果你还没读过基础教程,可以先看《5 分钟上手 Yady API》《用 Python 调通 Yady + DeepSeek-V4-Flash:省钱实战》,本篇是它们的"排期省钱版"。

一、峰谷到底怎么算(一张表看懂)

DeepSeek 官方把一天分成两段(北京时间 GMT+8):

  • 高峰时段:工作日(周一至周五)9:00–12:00、14:00–18:00
  • 空闲时段:其余约 17 个小时,价格统一为高峰的 一半
  • 周六、周日:全天统一按空闲价(即全天半价)
  • 法定节假日:全天统一按空闲价(即全天半价)

以主力模型 DeepSeek-V4-Flash 为例(单位:元 / 百万 tokens):

| 计费项 | 高峰(工作日白天) | 空闲(夜间/周末/节假日) | |---|---|---| | 输入·缓存未命中 | ¥3.00 | ¥1.50 | | 输入·缓存命中 | ¥0.10 | ¥0.05 | | 输出 | ¥9.00 | ¥4.50 |

再看旗舰 V4-Pro:高峰输出 ¥27、空闲 ¥13.5;高峰输入缓存命中 ¥0.30、空闲 ¥0.15。缓存命中这一项高峰比之前涨了 11 倍,但绝对值很低——只要你把长 system prompt、RAG 上下文复用起来,命中后输入成本能压到极低的水平。

结论很直白:实时交互留在白天高峰没问题(延迟低、体验好);但批量生成、离线摘要、数据标注、内容审核这类"不急着这一刻出结果"的任务,一律排到空闲时段,立刻省一半。

二、这省下来的是真金白银

举个真实场景:你有个客服质检脚本,每天跑 1 亿 tokens 的输出(约 ¥900 峰值 / 用 V4-Flash)。

  • 全在高峰期跑:约 ¥900 / 天
  • 全挪到夜间或周末:约 ¥450 / 天
  • 一个月(按 30 天)差值:¥13,500

如果是 RAG 长上下文、缓存命中率高,输入侧还能再降一个数量级。对中小团队来说,这就是半年一台服务器的钱。

而且这条规则官方明码标价、可验证——你随时能把调用时间戳和账单对上,不存在"低价站"那种"0 折但偷偷降级/掉包"的坑。

三、最小改动,把任务挪到谷时

好消息:错峰不需要改你的任何 Prompt、不需要换模型、不需要重写逻辑,只是"什么时候发请求"的问题。

方案 A:用系统的定时任务(最简单)

把批处理脚本挂到夜间 cron,例如每天 02:00 跑:

# crontab -e
0 2 * * *  /usr/bin/python3 /path/to/your_batch_job.py >> batch.log 2>&1
# 周末全天都便宜,也可以加排:
0 2 * * 6,0  /usr/bin/python3 /path/to/your_batch_job.py >> batch.log 2>&1

脚本本身完全不用动——它还是调同一个 Yady 端点、同一个 deepseek-v4-flash,只是被调度到了便宜的时段。

方案 B:在代码里做"忙时即时、闲时入队"

如果你希望实时部分立刻跑、批量部分自动延后,可以用一段极简的调度逻辑(无额外依赖):

from openai import OpenAI
from datetime import datetime

client = OpenAI(base_url="https://yczc.top/v1", api_key="sk-你的Key")

def is_peak():
    now = datetime.now()
    # 周末 / 法定节假日 => 全天半价,视为非高峰
    if now.weekday() >= 5:
        return False
    # 工作日高峰:9-12、14-18
    return (9 <= now.hour < 12) or (14 <= now.hour < 18)

def call_model(prompt, urgent=False):
    if is_peak() and not urgent:
        # 非紧急任务:入队,等空闲时段再跑(这里用打印示意,可换消息队列)
        print("[排队] 非紧急任务,将于空闲时段执行:", prompt[:30])
        return None
    resp = client.chat.completions.create(
        model="deepseek-v4-flash",
        messages=[{"role": "user", "content": prompt}],
    )
    return resp.choices[0].message.content

# 实时问答:urgent=True 立刻跑
print(call_model("帮我总结这段用户反馈", urgent=True))
# 批量摘要:默认排队到谷时
call_model("批量生成这 1000 条商品描述")

核心就一句话:同一个 Key、同一个模型、同一个端点,只是挑便宜的时间发。Yady 完全兼容 OpenAI 协议,你现有的 SDK 一行都不用改。

四、为什么用 Yady 来吃这波红利

  1. 同源官方渠道,倍率透明:Yady 上游是火山引擎官方 DeepSeek-V4-Flash,价格按官方价 1.27× 固定倍率,不随"促销"乱跳、不玩"0 折但掉包"的把戏。
  2. 官方峰谷规则如实传导:DeepSeek 的峰谷/周末半价,Yady 原样传递给你,你省到的就是官方省到的。
  3. 数据不出境、不降级:你的 Prompt 和代码只走境内合规通道,不会被截留训练、不会被换成别的来源。
  4. OpenAI 兼容,零迁移成本:把 base_url 改成 https://yczc.top/v1、模型名填 deepseek-v4-flash,现有代码直接跑(详见《把现有 OpenAI 代码迁移到 Yady:只改 3 行》)。
  5. 五、三个最容易踩的坑

  • 坑一:把实时交互也强行挪到谷时——高峰时段官方延迟最低,聊天、Agent 实时链路该白天就白天,别为了省几毛钱牺牲体验。
  • 坑二:以为缓存命中"免费"——命中价虽低,但仍计费;真正省钱的是"长上下文复用 + 谷时调度"组合拳。
  • 坑三:贪便宜去"0 折站"——低价站常通过逆向/账号池供给,模型可能被掉包、数据可能被截留,省的那点钱远不够一次泄露的代价。合规渠道的"半价"才是能写进财报的省钱。

---

把批处理排到夜间和周末,是 2026 年最划算的一次"不写代码的成本优化"。注册 yczc.top 领体验额度 → 把 base_url 指向 Yady → 给批量任务挂个夜间 cron,账单立刻好看一半。

延伸阅读:

  • 《5 分钟上手 Yady API:用 DeepSeek-V4-Flash 跑通第一个请求》
  • 《用 Python 调通 Yady + DeepSeek-V4-Flash:从拿 Key 到流式输出与省钱实战》
  • 《三张清单,10 秒判断你的 AI 中转站到底第几类》
配图 2
配图 2