所有博客
自动停机成本优化

自动停机:Runwhere.AI 如何帮你省掉大笔 GPU 账单

训练跑完忘关机是 GPU 浪费的头号元凶。Runwhere.AI 的自动停机在任务进程退出后立即释放资源,计费精确到秒,彻底消灭空跑计费。

RRunwhere.AI Team·2025年4月18日·5 分钟阅读

「我在睡觉,GPU 在烧钱。」——这是 GPU 用户吐槽最多的场景:训练脚本半夜跑完,实例却计费到第二天早上;周末提交的实验,周一才发现空跑了两天。

任务完成后自动释放 GPU 并停止计费

为什么总是忘关机

训练脚本跑完了,GPU 实例却还在计费——这不是偶发事故,而是很多团队的常态。晚上提交的任务半夜就跑完了,实例却一直计费到第二天上班;有人以为关掉本地终端就是关掉了云端机器;而多人共用的实例,往往谁也不敢确认此刻到底能不能关,于是谁也不关。说到底,这不全是用户粗心的问题,传统云平台的设计也有责任:在多数平台上,实例是否计费只取决于你有没有手动点「释放」,和训练进程有没有跑完毫无关系。靠自觉解决不了这个问题——人总会忘,尤其是一个月要跑几十上百个任务的时候。

Runwhere.AI 的做法:进程退出 = 任务结束 = 立即释放

自动停机的逻辑非常直接:平台监听任务主进程,退出信号一到就执行完整的收尾流程——保存日志、销毁容器、释放 GPU、计费归零,全程不需要你做任何操作。两个计费细节同样重要:计费精确到秒,不存在「不足一小时按一小时算」的凑整;任务在 pending 状态排队等待时不产生 GPU 费用,只有真正占用了节点才开始计费。

自动停机是 Runwhere.AI 从第一天起的默认行为,没有配置项也没有开关,因为我们认为「跑完就停」本该是算力平台的默认行为,而不是需要用户自己搭建的高级功能。

它的另一面:省心比省钱更重要

自动停机省下的账单很直观,但很多用户反馈,更大的价值是心理负担消失了:睡前提交任务不用再定闹钟起来关机,交互式调试时走开一会儿也不用心疼,月底对账时每一笔费用都对应真实的计算时间。如果你还在用「人肉关机」的方式管 GPU,不妨把下一个任务提交到 Runwhere.AI,跑完之后去账务页看一眼账单,对比「任务时长」和「计费时长」——它们应该完全相等。

想体验 Runwhere.AI?

Free 永久免费,自带云账号,无需信用卡,30 秒启动第一个 GPU 任务。

免费开始 →