本手册面向数据运营平台第一阶段设备治理与运营能力,覆盖服务检查、日常巡检、
备份恢复、发布回滚、安全管理、故障升级和运维培训。部署、离线包、备份和
恢复的执行证据见 docs/validation/WP13_DEPLOYMENT_BACKUP_RECOVERY_EVIDENCE.md。
本地工程环境已完成恢复核对;企业目标环境的安装、正式 RPO/RTO 演练和签字 仍需企业运维团队执行。
| 组件 | 主要职责 | 企业责任人状态 |
|---|---|---|
| 前端 | 用户界面和权限入口控制 | 待企业指定 |
| 后端 | API、认证授权、业务规则和审计 | 待企业指定 |
| PostgreSQL | 业务、治理和审计主数据 | 待企业指定 |
| Neo4j | 受控图关系投影 | 待企业指定 |
| MinIO | 文件与对象存储 | 待企业指定 |
| n8n | 受控流程运行 | 待企业指定 |
正式移交时应为每个组件指定主责、备岗和升级联系人,并记录工作时间与非工作 时间的联系路径。
备份至少覆盖 PostgreSQL、Neo4j、MinIO、配置文件、密钥引用、发布制品和校验 清单。生产密钥本身应由企业密钥系统管理,不应明文进入备份包或代码仓库。
恢复流程:
恢复失败时保留现场和日志,不覆盖最后一个可用备份。企业生产恢复必须经过 变更审批。
回滚应恢复上一版制品和兼容数据状态。若数据库迁移不可逆,发布前必须准备 经验证的数据回退脚本或恢复方案。
| 等级 | 示例 | 响应与升级 |
|---|---|---|
| P0 | 全站不可用、严重数据损坏、权限绕过 | 立即冻结变更,通知技术、业务和安全负责人,启动恢复或回滚 |
| P1 | 关键流程不可用、关键结果错误 | 当日组织处置,明确替代路径和关闭时间 |
| P2 | 非关键功能异常、局部性能下降 | 纳入迭代,持续跟踪影响范围 |
| P3 | 体验或低风险改进 | 纳入产品待办 |
故障记录应包含时间线、影响范围、检测方式、临时处置、根因、永久修复和验证 证据。未确认根因时不得用推测替代事实。
用户培训包括角色说明、设备台账、实体匹配、质量整改、运行维护、知识问答和 治理指标。运维培训包括健康检查、日志定位、备份恢复、发布回滚、安全审计和 故障升级。
建议现场练习:
培训签到、练习结果、问题记录和补训安排由企业培训负责人保存。
| 项目 | 当前状态 |
|---|---|
| 第一阶段用户操作指南 | 工程材料已就绪 |
| WP14 验收计划、用例和缺陷台账 | 工程材料已就绪 |
| WP13 安装、备份与恢复证据 | 本地证据已就绪 |
| 企业运维主责、备岗和升级联系人 | 待企业指定 |
| 企业目标环境安装 | 待企业执行 |
| 企业 RPO/RTO 恢复演练 | 待企业执行 |
| 用户与运维培训 | 待企业组织 |
| 正式验收与移交签字 | 待企业 UAT 完成后签署 |