最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

詳解如何實(shí)現(xiàn)Linux服務(wù)Crash后自動(dòng)重啟

 更新時(shí)間:2023年08月02日 16:49:28   作者:東風(fēng)微鳴技術(shù)博客  
近期碰到了一個(gè)?Linux?Systemd?服務(wù)?Crash,?Crash?后需要人工介入重啟.?那么,?有沒有辦法如何實(shí)現(xiàn)?Linux?服務(wù)?Crash?后自動(dòng)重啟,下面就來和大家分享一下

Systemd

Systemd Restart

Systemd 允許你對(duì)服務(wù)進(jìn)行配置,以便在服務(wù)崩潰時(shí)自動(dòng)重啟。

一個(gè)典型的單元文件是這樣的:

[Unit]
Description=Tailscale node agent
After=network-online.target
Wants=tailscale-weekly-update.timer

[Service]
Type=oneshot
ExecStart=/usr/bin/tailscale update -yes

[Install]
WantedBy=multi-user.target

在上面的例子中,如果守護(hù)進(jìn)程崩潰或被殺死,systemd 不會(huì)去管它。

不過,你可以讓 systemd 自動(dòng)重啟守護(hù)進(jìn)程,以防它崩潰或意外被殺掉。為此,你可以在 [Service] 中添加 Restart 選項(xiàng)。典型的示例如下:

[Unit]
Description=Lightweight Kubernetes
Documentation=https://k3s.io
Wants=network-online.target
After=network-online.target

StartLimitIntervalSec=600
StartLimitBurst=5

[Install]
WantedBy=multi-user.target

[Service]
Type=notify
EnvironmentFile=-/etc/systemd/system/k3s.service.env
KillMode=process
Delegate=yes
LimitNOFILE=1048576
LimitNPROC=infinity
LimitCORE=infinity
TasksMax=infinity
TimeoutStartSec=0
Restart=always
RestartSec=5s
ExecStartPre=/bin/sh -xc '! /usr/bin/systemctl is-enabled --quiet nm-cloud-setup.service'
ExecStartPre=-/sbin/modprobe br_netfilter
ExecStartPre=-/sbin/modprobe overlay
ExecStart=/usr/local/bin/k3s \
    server \

上述操作會(huì)對(duì)任何導(dǎo)致守護(hù)進(jìn)程停止的情況做出反應(yīng)...只要守護(hù)進(jìn)程停止,systemd 就會(huì)在 5 秒內(nèi)重啟它。

Restart 有 2 個(gè)可選參數(shù):

  • always
  • on-failure: 即故障時(shí)重啟. 涵蓋了最廣泛的故障情形,如信號(hào)不清和退出代碼不清:

在本例中,[Unit] 部分還有 StartLimitIntervalSec 和 StartLimitBurst 指令。這可以防止故障服務(wù)每 5 秒鐘重啟一次。如果仍然失敗,systemd 將停止嘗試啟動(dòng)服務(wù)。

如果服務(wù)在 600 秒內(nèi) 5 次嘗試重啟均未成功,則應(yīng)進(jìn)入失敗狀態(tài),不再嘗試重啟。這樣就能確保如果服務(wù)真的壞了,systemd 不會(huì)繼續(xù)嘗試重啟它。應(yīng)該人工上去處理了。

如果在守護(hù)進(jìn)程被殺死后詢問其狀態(tài),systemd 會(huì)顯示正在activating (auto-restart)。

Systemd OnFailure

重啟一項(xiàng)服務(wù)固然很好,但在某個(gè)單元出現(xiàn)故障時(shí)采取特定行動(dòng)就更好了。也許你使用的軟件有一個(gè)已知的錯(cuò)誤,要求在崩潰時(shí)刪除緩存文件,也許你想啟動(dòng)一個(gè)腳本來收集日志和系統(tǒng)信息,以便診斷問題。Systemd 允許你指定在服務(wù)失敗時(shí)運(yùn)行的單元。

[Unit]
Description=Lightweight Kubernetes
Documentation=https://k3s.io
Wants=network-online.target
After=network-online.target

StartLimitIntervalSec=600
StartLimitBurst=5
OnFailure=k3s-recovery.service

[Install]
WantedBy=multi-user.target

[Service]
Type=notify
EnvironmentFile=-/etc/systemd/system/k3s.service.env
KillMode=process
Delegate=yes
LimitNOFILE=1048576
LimitNPROC=infinity
LimitCORE=infinity
TasksMax=infinity
TimeoutStartSec=0
Restart=on-failure
RestartSec=5s
ExecStartPre=/bin/sh -xc '! /usr/bin/systemctl is-enabled --quiet nm-cloud-setup.service'
ExecStartPre=-/sbin/modprobe br_netfilter
ExecStartPre=-/sbin/modprobe overlay
ExecStart=/usr/local/bin/k3s \
    server \

此示例指定 OnFailure=k3s-recovery.service 來告訴 systemd,如果我的服務(wù)失敗,它就應(yīng)該啟動(dòng) k3s-recovery 單元.

k3s-recovery 單元只是一個(gè)運(yùn)行此腳本的一次性服務(wù)單元:

[Unit]
Description=K3s recovery

[Service]
Type=oneshot
ExecStart=/usr/local/sbin/k3s-recovery.sh

這個(gè)腳本可以做任何事情:執(zhí)行一些手動(dòng)變通方法讓服務(wù)重新運(yùn)行,向監(jiān)控系統(tǒng)發(fā)出警報(bào),或者壓縮一些臨時(shí)日志和應(yīng)用程序狀態(tài)以排除故障。示例如下:

#!/bin/bash

echo 'Attempting to recover!' > /tmp/recovery_info
systemctl stop k3s.service
/usr/local/sbin/k3s-killall.sh
systemctl start k3s.service
Systemd FailureAction reboot

還有一種可能, 重啟治百病! 所以 systemd 內(nèi)置了在單元故障時(shí)觸發(fā)系統(tǒng)重啟的功能。在本例中,當(dāng)單元發(fā)生故障時(shí),系統(tǒng)將優(yōu)雅地重新啟動(dòng):

[Unit]
Description=Lightweight Kubernetes
Documentation=https://k3s.io
Wants=network-online.target
After=network-online.target

StartLimitIntervalSec=600
StartLimitBurst=5
FailureAction=reboot

[Install]
WantedBy=multi-user.target

[Service]
Type=notify
EnvironmentFile=-/etc/systemd/system/k3s.service.env
KillMode=process
Delegate=yes
LimitNOFILE=1048576
LimitNPROC=infinity
LimitCORE=infinity
TasksMax=infinity
TimeoutStartSec=0
Restart=on-failure
RestartSec=5s
ExecStartPre=/bin/sh -xc '! /usr/bin/systemctl is-enabled --quiet nm-cloud-setup.service'
ExecStartPre=-/sbin/modprobe br_netfilter
ExecStartPre=-/sbin/modprobe overlay
ExecStart=/usr/local/bin/k3s \
    server \

FailureAction 有多種有效值: none, reboot, reboot-force, reboot-immediate, poweroff, poweroff-force, poweroff-immediate, exit, exit-force, soft-reboot, soft-reboot-force, kexec, kexec-force, halt, halt-force 和 halt-immediate.

總結(jié)

本文介紹了服務(wù)異常時(shí), 自動(dòng)處理故障的一些方式。Systemd 包含強(qiáng)大的功能,可自動(dòng)響應(yīng)以保持服務(wù)運(yùn)行。

到此這篇關(guān)于詳解如何實(shí)現(xiàn)Linux服務(wù)Crash后自動(dòng)重啟的文章就介紹到這了,更多相關(guān)Linux Crash后自動(dòng)重啟內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!

相關(guān)文章

最新評(píng)論

沙洋县| 泾川县| 闸北区| 凉城县| 梓潼县| 留坝县| 寿阳县| 水城县| 青铜峡市| 秦安县| 江陵县| 马山县| 阿克陶县| 柳河县| 土默特右旗| 台南县| 平安县| 社会| 肇东市| 宿松县| 舒城县| 商河县| 富阳市| 茶陵县| 伊春市| 隆化县| 库车县| 深圳市| 庆安县| 轮台县| 乐山市| 邳州市| 精河县| 绥宁县| 彰化县| 大渡口区| 鲁甸县| 崇明县| 昆明市| 诸暨市| 叙永县|