systemd
systemd 是 Linux 系统工具,用来启动守护进程,已成为大多数发行版的标准配置
1. 由来
历史上,Linux 的启动一直采用 init 进程,下面的命令用来启动服务
$ /etc/init.d/httpd start
# 或者
$ service httpd start
这种方法有两个缺点:
- 启动时间长:init 进程是串行启动的,只有前一个进程启动完成,才会启动下一个进程
- 启动脚本复杂:init 进程只是执行启动脚本,不管其他的事,脚本需要自己处理各种情况,这往往让脚本内容变的很复杂
2. systemd 概述
systemd 就是为了解决这些问题而诞生的,它的设计目标是,为系统的启动和管理提供一套完整的解决方案
根据 Linux 惯例,字母 d 是守护进程(daemon)的缩写, systemd 这个名字的含义,就是它要守护整个系统
使用了 systemd,就不需要再用 init 了,systemd 取代了 initd ,成为系统的第一个进程(PID 等于 1),其他进程都是它的子进程
# 查看 systemd 的版本
$ systemctl --version
systemd 的优点是功能强大,使用方便,缺点是体系庞大,非常复杂,事实上,现在还有很多人反对使用 systemd ,理由就是它过于复杂,与操作系统的其他部分强耦合,违反 " keep simple , keep stupid " 的 unix 哲学
3. 系统管理
systemd 并不是一条命令,而是一组命令,涉及到系统管理的方方面面
3.1 systemctl
systemctl 是 systemd 的主命令,用于管理系统
# 重启系统
$ systemctl reboot
# 关闭系统(关闭所有进程,然后内核会退出,最后 ACPI 信号会使 BIOS 关闭系统电源)
$ systemctl poweroff
# CPU 停止工作(关闭所有进程,内核退出,然后禁用 CPU,但是不会关闭电源)
$ systemctl halt
# 暂停系统(S3,挂起,内存中)
$ systemctl suspend
# 让系统进入冬眠状态(S4,挂起,硬盘中)
$ systemctl hibernate
# 让系统进入交互式休眠状态(内存和硬盘中)
$ systemctl hybrid-sleep
# 启动进入救援状态(单用户状态)
$ systemctl rescue
# 进入紧急救援模式
$ systemctl emergency
3.2 systemd-analyze
systemd-analyze 是用来查看启动耗时的
# 查看启动耗时
$ systemd-analyze
# 查看每个服务的启动耗时
$ systemd-analyze blame
# 显示瀑布状的启动过程流
$ systemd-analyze critical-chain
# 显示指定服务的启动流
$ systemd-analyze critical-chain NetworkManager.service
详细使用方法我在这篇文章中有介绍哦:如何查看开机启动时间
3.3 hostnamectl
hostnamectl 命令用于查看当前主机的信息
# 显示当前主机的信息
$ hostnamectl
# 设置主机名
$ hostnamectl set-hostname qwq
# 设置 pretty 名
$ hostnamectl set-hostname --pretty ovo
# 设置图标名
# 某些图形界面的应用程序会根据此设置给主机配上适当的图标,但需要注意按照 图标命名规范 命名
$ hostnamectl set-icon-name laptop
# 设置设备类型
# 设置系统的设备类型, 某些图形界面的应用程序 会根据此设置切换到合适的人机界面之类
# 取值范围如下:desktop(台式机),laptop(笔记本),convertible(折叠本),server(服务器),tablet(平板电脑),handset(智能手机),watch(智能手表),embedded(嵌入式设备),vm(虚拟机),container(容器),注意,若设为空字符串, 则表示将设备类型重置为默认值(通常由主板固件决定)
$ hostnamectl set-chassis laptop
# 设置环境标识
# 系统的部署环境标识,必须设为一个单独的单词且禁止包含任何特殊字符,常见的设置为: development(开发),integration(集成),staging(暂存),production(生产)
$ hostnamectl set-deployment production
# 设置地理位置标识
# 将系统的地理位置标识,必须设为一个人类易读字符串, 准确的描述出主机所在的物理位置
$ hostnamectl set-location xx大厦xx楼技术服务中心Tzyy
hostnamectl
还会显示,系统版本、内核版本、架构等信息
linux 主机名分为:
- 静态主机名(static hostname):静态主机名用于系统启动时设置内核参数,存储于/etc/hostname
- 临时主机名(transient hostname):临时主机名默认从网络配置中获取,如果静态主机名生效,则临时主机名没用
- pretty 主机名(理解为:优雅的主机名):pretty 主机名对字符几乎没有限制,可以设置为你喜欢的任意主机名
3.4 localectl
localectl 命令用于查看本地化设置
# 查看本地化设置
$ localectl
# 设置本地化参数
$ localectl set-locale LANG=en_GB.utf8
$ localectl set-keymap en_GB
# 列出所有 set-locale 的本地化参数
$ localectl list-locales
# 设置控制台的键盘映射
3.5 timedatectl
timedatectl 命令用于查看当前时区设置
# 查看当前时区设置
$ timedatectl
# 显示所有可用的时区
$ timedatectl list-timezones
# 设置当前时区
$ timedatectl set-timezone America/New_York
$ timedatectl set-time YYYY-MM-DD
$ timedatectl set-time HH:MM:SS
# 设置 RTC 时间
$ timedatectl set-local-rtc 1 #将RTC设置为本地时间
$ timedatectl set-local-rtc 0 #将RTC设置为UTC
Local time:本地时间,初始值来自于 RTC,由内核维护,系统启动之后和 RTC 就没有关系了,通常等于 RTC+ 时区值
Universal time:系统时间永远是 UTC ,在应用程序使用的时候转换为本地时间
real-time clock(RTC time):指硬件时间,一般是主板上的特殊电路,专用用于记录时间,有电池供电,不受服务器和操作系统的开启关闭影响,也称作 BIOS 时间
RTC in local TZ: no:表示未设置 RTC 时间
3.6 loginctl
loginctl 命令用于查看当前登录的用户
# 列出当前session
$ loginctl
# 列出当前登录用户
$ loginctl list-users
# 列出显示指定用户的信息
$ loginctl show-user yv
# 显示用户状态信息(显示简洁的已登录用户状态信息, 后跟最近的日志)
$ loginctl user-status root
# 向指定用户的所有进程发送退出信号
$ loginctl kill-user root
# 列出当前连接终端
$ loginctl list-session
# 向指定连接终端的所有进程发送退出信号,10 为 session 号
$ loginctl kill-session 10
4. unit
4.1 含义
systemd 可以管理所有系统资源,不同的资源统称为 unit(单元)
unit 一共分为 12 种:
- Service unit:系统服务
- Target unit:多个 Unit 构成的一个组
- Device Unit:硬件设备
- Mount Unit:文件系统的挂载点
- Automount Unit:自动挂载点
- Path Unit:文件或路径
- Scope Unit:不是由 Systemd 启动的外部进程
- Slice Unit:进程组
- Snapshot Unit:Systemd 快照,可以切回某个快照
- Socket Unit:进程间通信的 socket
- Swap Unit:swap 文件
- Timer Unit:定时器
systemctl list-units
命令可以查看当前系统的所有 unit
# 列出正在运行的 Unit
$ systemctl list-units
# 列出所有Unit,包括没有找到配置文件的或者启动失败的
$ systemctl list-units --all
# 列出所有没有运行的 Unit
$ systemctl list-units --all --state=inactive
# 列出所有加载失败的 Unit
$ systemctl list-units --failed
# 列出所有正在运行的、类型为 service 的 Unit
$ systemctl list-units --type=service
4.2 unit 的状态
systemctl status
命令用于查看系统状态和单个 unit 的状态
# 显示系统状态
$ systemctl status
# 显示单个 Unit 的状态
$ sysystemctl status httpd
# 显示远程主机的某个 Unit 的状态
$ systemctl -H root@yv status httpd
除了status
命令,systemctl
还提供了三个查询状态的简单方法,主要供脚本内部的判断语句使用
# 显示某个 Unit 是否正在运行
$ systemctl is-active httpd
# 显示某个 Unit 是否处于启动失败状态
$ systemctl is-failed httpd
# 显示某个 Unit 服务是否建立了启动链接
$ systemctl is-enabled httpd
4.3 unit 管理
# 立即启动一个服务
$ systemctl start httpd
# 立即停止一个服务
$ systemctl stop httpd
# 重启一个服务
$ systemctl restart httpd
# 杀死一个服务的所有子进程
$ systemctl kill httpd
# 重新加载一个服务的配置文件
$ systemctl reload httpd
# 重载所有修改过的配置文件
$ systemctl daemon-reload
# 显示某个 Unit 的所有底层参数
$ systemctl show httpd
# 显示某个 Unit 的指定属性的值
$ systemctl show -p CPUShares httpd
# 设置某个 Unit 的指定属性
$ systemctl set-property httpd CPUShares=500
4.4 依赖关系
Unit 之间存在依赖关系:A 依赖于 B,就意味着 systemd 在启动 A 的时候,同时会去启动 B
systemctl list-dependencies
命令列出一个 unit 的所有依赖
$ systemctl list-dependencies httpd
上面命令的输出结果之中,有些依赖是 Target 类型(详见下文),默认不会展开显示。如果要展开 Target,就需要使用--all
参数
$ systemctl list-dependencies --all httpd
5. unit 配置文件
5.1 概述
每一个 unit 都有一个配置文件,告诉 systemd 怎么启动这个 unit
systemd 默认从目录/etc/systemd/system/
读取配置文件。但是,里面存放的大部分文件都是符号链接,指向目录/usr/lib/systemd/system/
,真正的配置文件存放在那个目录。
systemctl enable
命令用于在上面两个目录之间,建立符号链接关系
$ systemctl enable httpd
# 等同于
$ ln -s '/usr/lib/systemd/system/httpd.service' '/etc/systemd/system/multi-user.target.wants/httpd.service'
如果配置文件里面设置了开机启动,systemctl enable
命令相当于激活开机启动
与之对应的,systemctl disable
命令用于在两个目录之间,撤销符号链接关系,相当于撤销开机启动。
$ systemctl disable httpd
配置文件的后缀名,就是该 unit 的种类,比如sshd.socket
,如果省略,systemd 默认后缀名为.service
,所以sshd
会被理解成sshd.service
Socket:套接字,ip地址 + 端口
作用:通信,返回状态
5.2 配置文件的状态
systemctl list-unit-files
命令用于列出所有配置文件
# 列出所有配置文件
$ systemctl list-unit-files
# 列出指定类型的配置文件
$ systemctl list-unit-files --type=service
这个命令会输出一个列表
$ systemctl list-unit-files
UNIT FILE STATE
chronyd.service enabled
clamd@.service static
clamd@scan.service disabled
这个列表显示每个配置文件的状态,一共有四种
- enabled:已建立启动链接
- disabled:没建立启动链接
- static:该配置文件没有
[Install]
部分(无法执行),只能作为其他配置文件的依赖- masked:该配置文件被禁止建立启动链接
注意,从配置文件的状态无法看出,该 unit 是否正在运行。这必须执行前面提到的systemctl status
命令
$ systemctl status httpd
一旦修改配置文件,就要让 systemd 重新加载配置文件,然后重新启动,否则修改不会生效
$ systemctl daemon-reload
$ systemctl restart httpd
5.3 配置文件的格式
配置文件就是普通的文本文件,可以用文本编辑器打开
systemctl cat
命令可以查看配置文件的内容
$ systemctl cat httpd
# /usr/lib/systemd/system/httpd.service
# See httpd.service(8) for more information on using the httpd service.
# Modifying this file in-place is not recommended, because changes
# will be overwritten during package upgrades. To customize the
# behaviour, run "systemctl edit httpd" to create an override unit.
# For example, to pass additional options (such as -D definitions) to
# the httpd binary at startup, create an override unit (as is done by
# systemctl edit) and enter the following:
# [Service]
# Environment=OPTIONS=-DMY_DEFINE
[Unit]
Description=The Apache HTTP Server
Wants=httpd-init.service
After=network.target remote-fs.target nss-lookup.target httpd-init.service
Documentation=man:httpd.service(8)
[Service]
Type=notify
Environment=LANG=C
ExecStart=/usr/sbin/httpd $OPTIONS -DFOREGROUND
ExecReload=/usr/sbin/httpd $OPTIONS -k graceful
# Send SIGWINCH for graceful stop
KillSignal=SIGWINCH
KillMode=mixed
PrivateTmp=true
[Install]
WantedBy=multi-user.target
从上面的输出可以看到,配置文件分成几个区块,每个区块的第一行,是用方括号表示的区别名,比如[Unit]
注意,配置文件的区块名和字段名,都是大小写敏感的,每个区块内部是一些等号连接的键值对,注意,键值对的等号两侧不能有空格
5.4 配置文件的区块
[Unit]
区块通常是配置文件的第一个区块,用来定义 unit 的元数据,以及配置与其他 Unit 的关系,它的主要字段如下
- Description:简短描述
- Documentation:文档地址
- Requires:当前 Unit 依赖的其他 Unit,如果它们没有运行,当前 Unit 会启动失败
- Wants:与当前 Unit 配合的其他 Unit,如果它们没有运行,当前 Unit 不会启动失败
- BindsTo:与
Requires
类似,它指定的 Unit 如果退出,会导致当前 Unit 停止运行- Before:如果该字段指定的 Unit 也要启动,那么必须在当前 Unit 之后启动
- After:如果该字段指定的 Unit 也要启动,那么必须在当前 Unit 之前启动
- Conflicts:这里指定的 Unit 不能与当前 Unit 同时运行
- Condition...:当前 Unit 运行必须满足的条件,否则不会运行
- Assert...:当前 Unit 运行必须满足的条件,否则会报启动失败
[Install]
通常是配置文件的最后一个区块,用来定义如何启动,以及是否开机启动,它的主要字段如下
值得注意的是:修改此字段需要先 disable 服务,然后进行修改添加,保存后需要 systemctl daemon-reload,然后 enabled 服务后即可使用
- WantedBy:它的值是一个或多个 Target,当前 Unit 激活时(enable)符号链接会放入
/etc/systemd/system
目录下面以 Target 名 +.wants
后缀构成的子目录中- RequiredBy:它的值是一个或多个 Target,当前 Unit 激活时,符号链接会放入
/etc/systemd/system
目录下面以 Target 名 +.required
后缀构成的子目录中- Alias:当前 Unit 可用于启动的别名,必须相同后缀的,例如:.service,注:不是所有服务都支持添加别名
- Also:当前 Unit 激活(enable)时,会被同时激活的其他 Unit
[Service]
区块用来 Service 的配置,只有 Service 类型的 Unit 才有这个区块。它的主要字段如下。
Type
:定义启动时的进程行为。它有以下几种值。
Type=simple
:默认值,执行ExecStart
指定的命令,启动主进程Type=forking
:以 fork 方式从父进程创建子进程,创建后父进程会立即退出Type=oneshot
:一次性进程,Systemd 会等当前服务退出,再继续往下执行Type=dbus
:当前服务通过D-Bus启动Type=notify
:当前服务启动完毕,会通知Systemd
,再继续往下执行Type=idle
:若有其他任务执行完毕,当前服务才会运行ExecStart
:启动当前服务的命令ExecStartPre
:启动当前服务之前执行的命令ExecStartPost
:启动当前服务之后执行的命令ExecReload
:重启当前服务时执行的命令ExecStop
:停止当前服务时执行的命令ExecStopPost
:停止当其服务之后执行的命令RestartSec
:自动重启当前服务间隔的秒数Restart
:定义何种情况 Systemd 会自动重启当前服务,可能的值包括always
(总是重启)、on-success
、on-failure
、on-abnormal
、on-abort
、on-watchdog
TimeoutSec
:定义 Systemd 停止当前服务之前等待的秒数Environment
:指定环境变量
6. target
启动计算机的时候,需要启动大量的 unit,如果每一次启动,都要一一写明本次启动需要哪些 unit,显然非常不方便。Systemd 的解决方案就是 target
简单说,target 就是一个 unit 组,包含许多相关的 unit,启动某个 target 的时候,systemd 就会启动里面所有的 unit,从这个意义上说,target 这个概念类似于 "状态点",启动某个 target 就好比启动到某种状态
传统的init
启动模式里面,有 RunLevel 的概念,跟 target 的作用很类似,不同的是,RunLevel 是互斥的,不可能多个 RunLevel 同时启动,但是多个 Target 可以同时启动
# 查看当前系统的所有 Target
$ systemctl list-unit-files --type=target
# 查看一个 Target 包含的所有 Unit
$ systemctl list-dependencies multi-user.target
# 查看启动时的默认 Target
$ systemctl get-default
# 设置启动时的默认 Target
$ systemctl set-default multi-user.target
# 切换 Target 时,默认不关闭前一个 target 启动的进程,systemctl isolate 命令改变这种行为:关闭前一个 target 里面所有不属于后一个 target 的进程
$ systemctl isolate multi-user.target
target 与 传统 RunLevel 的对应关系如下
Traditional runlevel New target name Symbolically linked to...
Runlevel 0 | runlevel0.target -> poweroff.target
Runlevel 1 | runlevel1.target -> rescue.target
Runlevel 2 | runlevel2.target -> multi-user.target
Runlevel 3 | runlevel3.target -> multi-user.target
Runlevel 4 | runlevel4.target -> multi-user.target
Runlevel 5 | runlevel5.target -> graphical.target
Runlevel 6 | runlevel6.target -> reboot.target
它与init
进程的主要差别如下:
- 默认的 RunLevel(在/etc/inittab文件设置)现在被默认的 Target 取代,位置是/etc/systemd/system/default.target,通常符号链接到graphical.target(图形界面)或者multi-user.target(多用户命令行)。
- 启动脚本的位置,以前是/etc/init.d目录,符号链接到不同的 RunLevel 目录 (比如/etc/rc3.d、/etc/rc5.d等),现在则存放在/lib/systemd/system和/etc/systemd/system目录。
- 配置文件的位置,以前init进程的配置文件是/etc/inittab,各种服务的配置文件存放在/etc/sysconfig目录。现在的配置文件主要存放在/lib/systemd目录,在/etc/systemd目录里面的修改可以覆盖原始设置。
7. 日志管理
Systemd 统一管理所有 Unit 的启动日志。带来的好处就是,可以只用journalctl
一个命令,查看所有日志(内核日志和应用日志)。日志的配置文件是/etc/systemd/journald.conf
journalctl
功能强大,用法非常多
# 查看所有日志(默认情况下 ,只保存本次启动的日志)
$ journalctl
# 查看内核日志(不显示应用日志)
$ journalctl -k
# 查看系统本次启动的日志
$ journalctl -b
$ journalctl -b -0
# 查看上一次启动的日志(需更改设置)
$ journalctl -b -1
# 查看指定时间的日志
$ journalctl --since="2012-10-30 18:17:16"
$ journalctl --since "20 min ago"
$ journalctl --since yesterday
$ journalctl --since "2015-01-10" --until "2015-01-11 03:00"
$ journalctl --since 09:00 --until "1 hour ago"
# 显示尾部的最新10行日志
$ journalctl -n
# 显示尾部指定行数的日志
$ journalctl -n 20
# 实时滚动显示最新日志
$ journalctl -f
# 查看指定服务的日志
$ journalctl /usr/lib/systemd/systemd
# 查看指定进程的日志
$ journalctl _PID=1
# 查看某个路径的脚本的日志
$ journalctl /usr/bin/bash
# 查看指定用户的日志
$ journalctl _UID=33 --since today
# 查看某个 Unit 的日志
$ journalctl -u httpd
$ journalctl -u httpd --since today
# 实时滚动显示某个 Unit 的最新日志
$ journalctl -u httpd -f
# 合并显示多个 Unit 的日志
$ journalctl -u httpd -u sshd --since today
# 查看指定优先级(及其以上级别)的日志,共有8级
# 0: emerg
# 1: alert
# 2: crit
# 3: err
# 4: warning
# 5: notice
# 6: info
# 7: debug
$ journalctl -p err # err 也可用用数字表示 journalctl -p err -b
# 日志默认分页输出,--no-pager 改为正常的标准输出
$ journalctl --no-pager
# 显示日志占据的硬盘空间
$ journalctl --disk-usage
# 指定日志文件占据的最大空间
$ journalctl --vacuum-size=1G
# 指定日志文件保存多久
$ journalctl --vacuum-time=1years
最后,我们经常会在启动服务等失败的时候看到 journalctl -xe
这是什么意思呢
$ journalctl -xe
# -x:问题相关目录会附在下面,例如收录并解决问题的网址
# -e:从最后开始查看,方便定位刚出现的问题
> Tip:还未完成更新,里面一些内容还在细化中