企业数据灾难恢复计划(DRP)编写指南:从模板到落地

去年有家做SaaS的公司被勒索病毒加密了整个生产库,老板问运维负责人:我们的灾难恢复计划呢?运维负责人说在脑子里。结果花了四天才恢复服务,客户流失了一大批。痛定思痛之后,他们花了两周写了一份正式的DRP文档,后来真的一次机房故障中,照着流程四十分钟就恢复了。这就是有文档和没文档的区别。

DRP不是文档,是制度

很多人觉得DRP就是写个Word文档放那儿备查。不是。DRP是一套从发现故障到恢复业务的完整流程,包括谁负责、怎么操作、联系谁、多久恢复。写出来只是第一步,更重要的是让团队都熟悉、定期演练、持续更新。

一份可落地的DRP包含六个部分

第一部分:资产清单。把所有生产系统列出来,包括服务器、数据库、中间件、域名、证书、第三方服务。每项标注负责人和联系方式。这份清单是恢复时的地图,没有它你都不知道该恢复什么。

第二部分:风险评估。针对每类资产,列出可能发生的故障:硬件损坏、网络中断、数据误删、安全攻击、机房级灾难。按发生概率和影响程度排序,优先保障高影响高概率的场景。

第三部分:恢复策略。对每个关键系统定义RTO和RPO。比如核心数据库RTO等于30分钟、RPO等于5分钟;官网RTO可以放宽到4小时、RPO为24小时。然后说明对应的恢复手段:热备切换、备份恢复、降级方案等。恢复策略要跟数据迁移备份方案对齐,备份频率和保留周期要满足RPO要求。

第四部分:应急流程。写清楚从告警触发到完全恢复的每一步操作。格式要像菜谱一样具体:第一步登录堡垒机,第二步执行什么脚本,第三步验证什么指标。别写根据情况灵活处理——出事的时候没人有心情灵活处理。每个步骤标注预计耗时,加起来不能超过RTO。

第五部分:通讯录。内部团队联系人、云厂商技术支持电话、供应商联系方式。要包含非工作时间能联系到人的渠道,半夜三点出事你打工作时间客服电话没人接。

第六部分:演练计划。每季度至少做一次桌面推演,每年至少做一次实际切换演练。演练完写复盘记录,更新DRP文档。文档更新日期超过半年没动,基本就废了。

DRP不需要写得多厚,能落地就行。一页纸的检查清单,有时候比五十页的文档更有用。关键是团队能照着做、做过有效、持续在更新。

相关推荐

延伸阅读

常见问题

找软件开发公司之前,先搞清楚这五个问题

准备找软件开发公司做项目,但不知道从哪开始沟通?别上来就问价格,先搞清楚这五个问题。问对了,沟通效率高、报价也更有参考价值。

2026-07-24
技术博客

别再往localStorage里塞token了,这些坑你踩过几个

<h2>误区一:localStorage存token,方便就完事了</h2><p>这是前端圈子里流传最广的偷懒写法。新手教程里经常这么教——登录成功后拿到token,顺手localStorage.setItem存起来,下次请求带上就行。看起来没毛病,实际上埋了一颗定时炸弹。</p><p>不少已经上线跑了一两年的项目,至今还在用这种方式管理登录态。开发者觉得又不是银行系统没那么严格,但现实是:只要你的页面存在一个XSS漏洞,攻击者一行document.cookie都不用碰,直接读localStorage就能把token拿走。</p><h2>误区二:我做了输入校验,XSS不会发生在我这里</h2><p>很多团队的安全意识停留在输入框做了过滤就行。但XSS的攻击面远不止表单输入。第三方脚本、富文本编辑器、URL参数拼接、甚至CDN被污染,都可能成为注入点。</p><p>更麻烦的是,现代前端项目依赖大量npm包,供应链攻击已经不是新闻了。某个深层依赖被植入恶意代码,打包后混在你的业务JS里,运行时悄悄把localStorage里的内容发到外部服务器——这种事不是假设,是真实发生过的安全事件。</p><h2>为什么这些做法是错的</h2><p>根本原因在于:localStorage对JavaScript完全开放。任何在当前域下执行的JS代码,不管是你自己写的还是被注入的,都能无条件读写localStorage的全部内容。它没有访问控制,没有过期机制,没有加密,就是一个对脚本透明的键值仓库。</p><p>换句话说,localStorage的设计初衷就不是用来存敏感信息的。它适合存主题偏好、语言设置这类丢了也无所谓的数据。把身份凭证放进去,相当于把家门钥匙挂在门把手上——门锁本身可能很结实,但钥匙谁都能拿。</p><p>而sessionStorage虽然生命周期短一些,关闭标签页就清除,但在XSS面前同样毫无抵抗力,本质问题一模一样。</p><h2>正确做法:httpOnly Cookie方案</h2><p>把token的存储和传输交给httpOnly Cookie。具体操作是:后端在登录接口的响应头里通过Set-Cookie下发token,同时设置httpOnly、Secure、SameSite属性。</p><p>httpOnly的作用很直接——禁止JavaScript读取这个cookie。就算页面被XSS了,攻击者的脚本也拿不到cookie内容。Secure确保只在HTTPS下传输,SameSite限制跨站请求携带,三者组合起来构成基本防线。</p><p>前端这边不需要手动管理token了。浏览器会自动在同域请求里带上cookie,接口该怎么调还怎么调。如果是跨域场景,配合credentials include和后端的CORS白名单即可。</p><h3>补充:短期token加refresh机制</h3><p>access_token设置较短过期时间(比如15分钟),refresh_token放在httpOnly cookie里,过期后静默刷新。这样即使access_token意外泄露,窗口期也非常有限。</p><h2>上线前自查清单</h2><p>以下几项逐条过一遍,没做到的赶紧补:</p><p>1. localStorage和sessionStorage里是否还残留token、密码、用户敏感信息?全部清理掉。</p><p>2. 身份凭证是否已迁移到httpOnly Cookie?确认Set-Cookie响应头包含httpOnly、Secure、SameSite=Strict或Lax。</p><p>3. 前端是否存在innerHTML直接拼接用户输入的写法?逐一排查并替换为textContent或经过转义处理。</p><p>4. 第三方脚本是否使用了integrity属性做子资源完整性校验?没有的话加上SRI hash。</p><p>5. CSP头是否已配置?至少限制script-src为白名单域,杜绝inline脚本执行。</p><p>6. 定期跑一次依赖审计(npm audit),看看有没有已知漏洞的包还在项目里。</p><p>安全这件事没有一劳永逸的方案,但至少别在最基础的地方翻车。把token从localStorage挪出来,是成本最低、收益最明确的一步。</p>

2026-07-24
行业资讯

AI代码助手用了半年,团队的开发效率到底提升了多少

2025年团队全面引入了AI代码辅助工具。半年用下来,有好的变化也有新的问题。这篇是来自一线开发团队的实测数据和使用感受,不吹不黑。

2026-07-24
电话咨询 微信咨询 在线咨询 返回顶部
xycx202108

微信扫码咨询

×