Posts
Kubernetes cgroup v2 迁移实践
K8s 1.25+ 默认启用 cgroup v2,MemoryQoS 和 PSI 等新特性只在 v2 支持。本文给出完整的节点迁移操作流程和常见问题解决方案。
USE Method:系统性能分析方法论
随机尝试是性能排查的大敌。USE Method 用一个三维框架(使用率/饱和度/错误)把所有系统资源纳入统一分析体系,本文从原理到实战全面解析这套方法论,并提供 K8s 环境下的 PromQL 映射和工具链速查表。
bpftrace 实战:线上问题排查的瑞士军刀
strace 太重、perf 太原始、BCC 工具集要装一堆依赖——bpftrace 是这三者之间的平衡点。本文用四个真实场景讲清楚 bpftrace 的工作方式,帮你把它变成日常排查工具。
FinOps 实践:Kubernetes 成本治理体系建设
一套完整的 Kubernetes FinOps 落地路径:如何识别僵尸资源、配置成本分摊模型、利用 Karpenter 降低节点成本,以及如何将月账单从 $50k 压到 $30k。
gRPC 微服务实践:协议、负载均衡与 Kubernetes 集成
从协议原理到 Kubernetes 生产落地,系统梳理 gRPC 微服务的核心实践:Protobuf 向后兼容设计、拦截器链(日志/限流/OTel)、长连接负载不均问题(headless Service + round_robin vs Envoy L7)、健 …
Kubernetes v1.33 新特性深度解读:GA 特性全览与升级指南
Kubernetes v1.33 带来了多项重量级 GA 特性,本文深入解读 In-Place Pod Vertical Scaling、原生 Sidecar Containers、Pod Scheduling Readiness、KMS v2 加密等核心变更 …
PostgreSQL 高可用实战:Patroni + HAProxy + etcd 完整部署指南
详解 Patroni 自动故障转移机制,手把手完成 etcd 三节点集群搭建、Patroni 完整配置(含 pg_hba.conf 托管)、HAProxy 读写分离配置,以及 kill primary 故障切换演练全过程。
Service Mesh 技术选型:Istio vs Cilium vs Linkerd 深度对比
Istio、Cilium Service Mesh、Linkerd 三种方案各有侧重:Istio 功能最全但最重,Cilium 基于 eBPF 性能最优,Linkerd 最轻量最易运维。本文从架构、性能、功能、运维四个维度全面拆解,帮助架构师做出有数据支撑的选 …