Leo Blog

刘晓鹏的博客

本文是《Kubernetes 面试问答》系列的刁钻篇(生产实战),共 16 题:Pod Pending / CrashLoopBackOff / ImagePullBackOff 排查、节点 NotReady 与证书、滚动更新卡住、两个控制器抢 Pod、DNS 与 CoreDNS 打满止血、etcd 数据恢复、Longhorn drain 卡住、RKE2 升级回退、控制面高可用深挖、默认权限与切换用户、多角色 RBAC 实例、反直觉故障合集,全部是生产上真会遇到的问题。

阅读全文 »

本文是《Kubernetes 面试问答》系列的进阶篇,共 24 题,讲原理与进阶用法:控制器 Reconcile 循环、Pod 创建全流程与 Scheduler 调度、kube-apiserver 准入控制、kube-proxy iptables/IPVS、CNI 选型、CoreDNS 与 dnsPolicy/ndots、StatefulSet 稳定标识与 Headless Service、StorageClass/CSI/Longhorn、Helm Chart、HPA 自定义指标、etcd 备份恢复与 RKE2、RBAC 与 ServiceAccount 深化、蓝绿/金丝雀发布、探针最佳实践。

阅读全文 »

本文是《Kubernetes 面试问答》系列的基础篇,共 20 题,覆盖 K8s 架构与核心组件、Pod 生命周期、Deployment/ReplicaSet 与滚动更新回滚、更新策略、Service 与 Ingress、ConfigMap/Secret、存储挂载方式与 PV/PVC/StorageClass 动态供给、工作负载类型、调度控制(nodeSelector/亲和性/污点容忍/反亲和性)、命名空间与资源配额、三种探针、HPA 水平扩缩容、RBAC 基础,每题附参考回答与追问。

阅读全文 »

“我在驻场运维时遇到一个很实际的场景:客户要把几十万个小文件从旧机器迁到新机器,Windows 资源管理器拷了一下午还没拷完。我分析下来瓶颈不在带宽,而在机械硬盘的随机 IO——每个小文件都伴随一次寻道加旋转延迟,几万个文件就是几万次随机 IO,所以特别慢。我用 Python 写了一个针对 NTFS…

阅读全文 »

我在神州信息做 Linux 系统工程师期间,主导了公司 CMDB 系统的容器化改造。这套 CMDB 原来是 Tomcat + MySQL + Elasticsearch 的传统架构,跑在虚拟机上,环境不一致、手动发布、扩缩容难,而且客户机房是无外网环境,交付部署周期很长。我牵头做了整体方案:用 K3…

阅读全文 »

“我们做了一个面向政企场景的 RAG 智能问答平台,内部代号 LarkLex。这个项目是团队 2024 年并行推进的两大目标之一——另一个是容器平台改造;LarkLex 的定位是私有 LLM 编排(Private LLM orchestration),目标是做成开源产品。我负责它从架构设计到部署运维…

阅读全文 »

本文整理了Git 面试问答(26 题)相关的 26 个高频面试问题,从基础到进阶再到生产实战层层递进,覆盖Git、面试等核心考点,每题附参考回答与追问,适合面试前系统复习。

阅读全文 »