当 Linux 启动缓慢或进入错误的运行状态时,有效恢复的前提是先知道该查看什么,再决定是否修改。本动手课程把内核消息、启动存储、GRUB 配置、systemd target、启动耗时和内核模块串联成一套实用的故障排查流程。
你将在运行中的系统上进行检查、执行受控的临时变更,并把证据保存为报告文件。最终恢复挑战要求你捕获内核命令行、记录测试模块信息、将其从运行中的内核卸载,并把系统隔离到基于文本的多用户模式。
你将学到什么
- 使用
dmesg阅读早期内核消息并识别当前启动命令行 - 判断
/boot的存储方式,并安全查看自动生成的 GRUB 菜单配置 - 解读
ro、rw和init=/bin/bash等内核启动参数 - 查看 systemd target,并使用
systemctl isolate切换当前运行状态 - 安排、验证并取消延迟重启,避免系统真正重启
- 测量启动耗时,并比较
systemd-analyze blame与critical-chain - 查看、模拟、装载、验证并卸载安全的测试内核模块
本课程适合谁
本中级课程适合需要系统学习启动诊断和受控恢复操作的 Linux 管理员、DevOps 学习者、支持工程师和开发者。当你需要调查启动缓慢、异常运行状态、引导参数或可疑内核模块时,本课程尤其有用。
前置要求: 能够熟练使用 Linux 终端、管道与重定向、文件查看和 sudo。了解服务与 systemd 基础会更有帮助。
学习环境: 基于 systemd 的 LabEx Linux 终端,提供自动生成的 GRUB 配置和启动诊断信息,并允许受控切换 target 以及操作 dummy 内核模块。
常见问题
课程会重启机器或直接编辑 GRUB 配置吗?
不会。你会安排十分钟后的重启、验证其已被系统记录,然后取消它。你会读取 grub.cfg 并识别其中的内核启动行,但不会编辑这个自动生成的文件,也不会重启进入救援 shell。
systemd-analyze blame 和 critical-chain 有什么区别?
blame 按各单元自身的启动耗时排序,critical-chain 则展示依赖顺序以及启动关键路径上的时间。耗时较长的单元不一定真正阻塞启动,因此课程会结合两种视图判断。
内核模块练习对实验系统安全吗?
课程专门使用 dummy 网络设备模块进行受控测试。你会先用 modprobe -n -v 预览操作,再装载、验证并卸载模块;最终挑战也要求在卸载前记录该模块的详细信息。





