RHCE in Enterprise Linux Prep (EX342) 是一门引导式故障排查课程,用于建立严谨的 RHEL incident 响应能力。28 个实验分为 6 个阶段:证据与方法;启动、服务、内核和硬件症状;存储恢复;软件包完整性;网络与应用 incident;认证与高级调查。
在 140 个可验证步骤中,你会先观察症状再改变状态,使用文档与日志缩小原因范围,执行受控修复,并保存最终结果证据。每个实验标注 35–50 分钟,总练习时间为 1,235 分钟,可在独立 incident 前安全学习高级工具与恢复流程。
你将学到什么
- 收集基线、解读日志与指标、配置持久日志并创建聚焦的支持归档
- 诊断服务依赖、恢复 target、bootloader 漂移、硬件信号、内核模块与持久参数
- 修复测试文件系统、LVM 可见性、加密卷、UUID 挂载、iSCSI 登录和容量耗尽
- 解决仓库、依赖、RPM 数据库、软件包文件完整性和更新失败问题
- 修复 NetworkManager、DNS、路由、流量、防火墙、应用库、SELinux denial 与 Podman 服务
- 诊断 PAM、身份查询、进程内存和应用级运行时问题
- 检查 kdump 就绪状态,并在不触发崩溃的情况下编译和运行最小有界 SystemTap probe
本课程适合谁
本课程适合希望在评估式 incident 前获得复杂排障引导练习的 RHEL 管理员、Linux 技术支持工程师和面向 EX342 的学习者。单个实验虽然讲解细致,但整体课程默认你已具备系统管理能力。
前置要求: 具备 RHCSA 水平的 RHEL 管理能力,包括 systemd、文件与权限、用户、软件包、网络、存储、Shell 工具、SELinux 和基础 Podman 使用。建议有排障实践;不要求已有高级 crash 或 SystemTap 经验。
学习环境: 每个实验都会打开一台独立、可通过浏览器访问的 RHEL 10 VM,包含受控本地故障及所需服务、仓库、磁盘镜像、存储 target、网络、用户、日志和诊断工具。可能造成破坏的操作使用训练资源与有界流程,不接触生产数据或基础设施。
常见问题
本课程与 Enterprise Linux 模拟考试有什么区别?
备考课程通过解释命令和检查点教授观察、诊断、修复和证据收集;模拟考试只提供独立 incident 简报和最终状态条件,指导少得多。
开始前需要高级故障排查经验吗?
不要求高级诊断工具经验,但需要扎实的 RHCSA 水平管理基础。实验会解释排障流程,同时默认你理解被修复的 Linux 组件。
启动、文件系统或 kdump 实验会故意让 VM 崩溃或重启吗?
不会。启动恢复使用受控账户和持久 target 状态,文件系统修复使用测试镜像,kdump 仅检查内存预留、服务就绪状态和训练输出路径,不触发内核崩溃。
存储、网络和容器 incident 会连接外部系统吗?
不会。iSCSI target、加密卷、路由、服务和 Podman 资源都在每个隔离实验内准备。你会进行真实的本地排障,但不依赖生产主机、外部存储或云。




