<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Node NotReady :: Ay Docs</title>
    <link>https://ops.docs.72602.space/using/k8s/node_not_ready/index.html</link>
    <description>当 Kubernetes 中某些 Node 节点状态变为 NotReady 时，这往往意味着 kubelet 无法与控制平面（API Server）正常通信，或该节点上某些关键组件/资源异常。&#xA;我们可以从以下两个层面来分析： 1️⃣ 导致节点 NotReady 的常见原因 2️⃣ NotReady 状态对整个集群和业务的影响&#xA;🧩 一、Node NotReady 的常见原因分类 kubelet 每 10 秒（默认）向 API Server 报告一次心跳（NodeStatus）。 如果连续 40 秒（默认 --node-monitor-grace-period=40s）没有收到更新，Controller Manager 会将节点标记为 NotReady。&#xA;下面按类别详细分析👇&#xA;🖧 1. 网络层异常（最常见） 症状：节点能 ping 通外网，但与 control plane 交互超时。 原因包括：&#xA;节点与 kube-apiserver 之间的网络中断（如防火墙、路由异常、VPC 问题）； API Server 负载均衡异常（L4/L7 LB 停止转发流量）； Pod 网络插件（CNI）崩溃，kubelet 无法汇报 Pod 状态； 节点 DNS 解析异常（影响 kubelet 访问 API Server）。 排查方式：&#xA;# 在节点上检查 API Server 可达性 curl -k https://&lt;apiserver-ip&gt;:6443/healthz # 检查 kubelet 日志 journalctl -u kubelet | grep -E &#34;error|fail|timeout&#34; ⚙️ 2. kubelet 本身异常 症状：节点长时间 NotReady，重启 kubelet 后恢复。</description>
    <generator>Hugo</generator>
    <language>en</language>
    <lastBuildDate></lastBuildDate>
    <atom:link href="https://ops.docs.72602.space/using/k8s/node_not_ready/index.xml" rel="self" type="application/rss+xml" />
  </channel>
</rss>