Skip to main content
三档。知道一样东西属于哪一档,就知道它值得投入多少精力。

第一档 —— 不可替代

第二档 —— 丢了很贵,但能重建

第三档 —— 不用管

<root>/cache/corpora<root>/packages(启用对象存储时)、 以及已完成 run 的 <root>/runs/**/work。全都能重建,磁盘紧张时本来也会被回收。

备份数据库

schema 迁移在启动时自动执行,所以把 dump 恢复到更新的构建上会被向前迁移。 把 dump 恢复到更旧的构建上不受支持——记下每个 dump 来自哪个版本。

恢复

1

停掉控制台

或者先进维护模式让作业排空——见维护模式
2

同时恢复数据库和存储根

两者必须彼此一致。数据库里引用了一个从更旧快照恢复出来的 run 目录, 结果就是它显示出一些并不存在的产物。
3

恢复密钥

尤其是 FORGE_SECRET_ENC_KEY。没有原来那把,存储的集成凭据解出来什么都不是, 每个用户都得重新关联一遍。
4

启动,然后检查

GET /api/version 有响应、作业列表能渲染、某个已完成的 run 仍然能看到它的产物。
演练一次恢复。没有人恢复过的备份只是一个假设,而它的失败方式—— 在事故处理过程中才发现加密密钥丢了——是最贵的那一种。

不在范围内的

平台之外的训练数据,以及容器镜像。两者都归别人备份: 你推送过的数据集,事实来源是对象存储;镜像的事实来源是你的镜像仓库。