📖 名词释义
AI Box(又称 AI盒子 / 智能体计算机 / Agent Computer),是一种专门运行 AI Agent 的本地硬件设备,预装智能体应用管理系统,开箱即用,7×24 小时在线运行。用户可以通过微信、飞书、企业微信、钉钉等社交软件远程指挥 AI 帮你干活。
摘要: 6月29日DeepSeek一封邮件炸了开发者社区——V4正式版7月中旬上线,白天API调用价格翻倍。一个普通打工人,光是AI月费一年就多出一部手机的钱。但避峰调用真的省钱吗?我算了一笔账,还有一个更彻底的方案。
上周朋友群炸了一条消息:DeepSeek V4正式版7月中旬上线,同步推出峰谷定价。工作日上午9点到12点、下午2点到6点,API调用价格翻倍。
翻译成人话:白天你用AI干活,要多掏一倍的钱。
我当即拿出计算器,对着公司一个同事的API账单算了一笔账。

先搞清楚到底贵了多少
按DeepSeek公布的定价,V4 Pro平时每百万token输入3元、输出6元。高峰时段各翻一倍:输入6元、输出12元。
这是他们最良心的模型了。用GPT-5.5的,平时每百万token就要11元输出,高峰时段直接蹿到22元。
我同事典型用法:每天写代码问AI约50次,每次平均2000 token输入+800 token输出。一个月22个工作日。
平时价:50×22×(2000×3+800×6)/1000000 = 50×22×(6+4.8)/1000000 = 50×22×10.8/1000000 ≈ 每月11.9元。听着不多是吧?
但上班时间全落在高峰时段里。高峰期价:50×22×(2000×6+800×12)/1000000 = 50×22×(12+9.6)/1000000 = 50×22×21.6/1000000 ≈ 每月23.8元。
一个月多12块,一年144元。这是最低配用法。换成重度用户——每天200次调用、每次5000 token——高峰一年多掏1200元。够买一部红米手机。
这不是极端案例。AI编程工具(Cursor、Codex、GitHub Copilot)每天都在后台默默调API,你敲一行Tab补全就是一个请求。一天下来少则上百次、多则上千次。

你可能会说"那我避峰用就好了"
对,听起来很简单。晚上8点以后用AI、周末用AI,价格跟以前一样。
但问题来了:你工作什么时候干?
方案A:白天正常干活,涉及AI的部分攒着,晚上一起问。代价是——你白天写的代码没法即时调试、下午出的Bug要等到晚上搞定、下午会议上同事说"这个方案AI跑一下看看"你只能说"等我晚上再输出"。
方案B:直接晚上上班。那你跟海外团队对齐时区就好了。
避峰定价的精妙之处就在这:它不禁止你省钱,它赌你根本省不了。因为你的工作节奏和AI使用场景天然锁死在高峰时段。
本地AI:一个不太明显但彻底的解法
就在帮同事算账的第二天,我把自己工位上那台铠盒AIBOX调出来看了一圈。
这盒子去年底就放在那了,一直插着网线跑一些后台任务。我忽然意识到:它上面跑的大模型,调用是不按次计费的。
用大白话说:你今天调100次、明天调1000次,账单都是零。因为你用的是自己的算力,不是租的。
来算另一笔账。
以DeepSeek V4 Flash的等价模型为例,在铠盒AIBOX上本地跑。重度用户每天200次调用、每次5000 token,高峰期云端一年花费约1200元。本地这边:硬件一次投入,之后每次调用增量成本为零。
按三年周期算,云端最低3600元(只涨不跌的概率更大)。本地就是硬件成本,之后零边际支出。
更关键的是:不管DeepSeek明天宣布涨价还是降价,跟你没关系。你的AI自由不在别人的定价公告里。

比价格更值钱的,是创作自由
价格之外还有一个隐形的东西:节奏。
云端AI你用着用着就养成了一个习惯——每次发请求前,心里都在默算这个问题的token量。长文分析要不要切段?历史对话要不要清空?多问一句会不会超预算?
这种"计费意识"本身就是创作的天敌。就像你写作时旁边放了一个计时器,心里总有个声音在催你快一点、省着点。
本地AI把这块天花板卸掉了。你想让模型读20万字长文再来回讨论半小时,就跟喝水一样自然。因为它不会产生新账单。
最近在看一个数据:2026年上半年,国内AI API调用量同比增长340%,但企业AI预算增速只有40%。这个剪刀差意味着什么?意味着越用越贵的趋势不会变。峰谷定价是第一个信号,后面可能是更多维度的"精细化定价"。
而本地AI的最大价值,就是让你从这个游戏中退出来。
延伸阅读
想继续了解本地AI,推荐看看前两篇实测文章: - 云端 vs 本地智能体4项实测对比 - 别再交月费了:大模型搬回家一次买断
想要进一步了解铠盒AIBOX,欢迎联系邮箱:[email protected]