惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 聂微东
Y
Y Combinator Blog
WordPress大学
WordPress大学
L
LangChain Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
A
About on SuperTechFans
小众软件
小众软件
有赞技术团队
有赞技术团队
S
SegmentFault 最新的问题
宝玉的分享
宝玉的分享
Recent Announcements
Recent Announcements
GbyAI
GbyAI
I
InfoQ
The GitHub Blog
The GitHub Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
酷 壳 – CoolShell
酷 壳 – CoolShell
罗磊的独立博客
C
Check Point Blog
V
V2EX
Apple Machine Learning Research
Apple Machine Learning Research
月光博客
月光博客
量子位
雷峰网
雷峰网
Hugging Face - Blog
Hugging Face - Blog

陈少文的网站

巨变与机遇的未来十年 Kubernetes 平台管理软件压力测试方案 使用镜像部署 Hexo 静态页面 终于等到你 - GitHub 镜像仓库服务(ghcr.io) 一起来学 Go --(6)Interface 一起来学 Go --(5)Goroutine 和 Channel 什么是函数式编程 如何在 Kubernetes 集群集成 Kata 柯里化与偏函数 使用 PyGithub 自动创建 Label 软件产品是团队能力的输出 Helm 2 、Helm 3 比较 IoT 变现 Kubernetes 中的 DNS 服务 国内的 Helm 镜像源 Harbor 使用自签证书支持 Https 访问 DevOps 工具链之 Prow 如何使用 kfctl 安装 Kubeflow VS Code 无法下载 Go 插件的工具包 工程师更应具有服务精神 你不知道的 Docker 使用技巧 使用 Docker 运行 Tensorflow 论中国 什么是左移 如何清空 Git 仓库全部历史记录 一禅小和尚 有风吹过厨房 时间的玫瑰 如何在 CentOS 安装 GPU 驱动 开发 Tips(19)
kubectl logs 无法查看 Pod 日志报错 NotFound
微信公众号 · 2025-02-22 · via 陈少文的网站

1. 现象

  • 能查看 Pod 的信息
1
2
3
4
kubectl -n my-testns get pod my-testpod

NAME         READY   STATUS    RESTARTS   AGE
my-testpod   1/1     Running   0          2d13h
  • 不能查看 Pod 的日志
1
2
3
kubectl -n my-testns logs my-testpod -f

Error from server (NotFound): the server could not find the requested resource ( pods/log my-testpod)

在 Pod 所在主机上可以通过 docker logs 查看容器日志。

  • 测试 Kubelet 的健康状态 OK
1
curl -k https://x.x.x.x:10250/healthz

这里要使用主机的 IP 地址,kubectl logs 命名会直接调用 Kubelet 的 API 获取容器日志。

  • 不能 exec 到 Pod 中
1
2
3
kubectl -n my-testns exec -it  my-testpod -- bash

Error from server:

没有详细输出错误详情。

  • kube-apiserver 中没有相关的错误日志
1
kubectl -n kube-system logs -l component=kube-apiserver -f
  • top 节点无法查看 Metrics
1
2
3
kubectl top node node-3

Error from server (NotFound): nodemetrics.metrics.k8s.io "node-3" not found
1
2
3
4
5
6
7
kubectl top node

node-03     246m         0%          4921Mi          7%
node-11      1929m        1%          152378Mi        14%
node-26     <unknown>    <unknown>   <unknown>       <unknown>
node-28     <unknown>    <unknown>   <unknown>       <unknown>
node-01     <unknown>    <unknown>   <unknown>       <unknown>

无法查看 Metrics Server Pod 所在节点的指标,有时部分可以。

  • Metrics Server 容器异常报错
1
E0221 06:27:28.020225       1 scraper.go:149] "Failed to scrape node" err="request failed, status: \"403 Forbidden\"" node="node-01"

2. 解决办法

  • 在 Kubelet 中添加 node-ip
1
vim /var/lib/kubelet/kubeadm-flags.env

添加 --node-ip=x.x.x.x,然后重启 kubelet,这里的 x.x.x.x 是主机的 IP 地址。

这种方式是 Issues 提到的解决办法,但是对于我们无效。

  • 删掉问题节点上的 Metrics Server

能够临时解决问题,Metrics Server 会重新部署到其他节点上导致出现类似的问题。

  • 修改 Metrics Server 的版本

在 Kubernetes 1.25.6、Docker 20.10.7 上,将 Metrics Server 从 0.7.1 降级到 0.6.2 之后恢复,应该是 Metrics Server 的高版本对 Docker 的兼容性问题。

3. 参考