你好,欢迎来到运维手记。这里主要记录我在 Linux 运维、Kubernetes、性能调优、监控告警、故障排查等领域的实战经验。 写给同样在生产环境里摸爬滚打的同行。

我 2018 年入行,从基础的服务器运维开始,后来转 SRE 方向。 这些年踩过的坑比写过的代码多,**所以这个博客里大部分是"踩坑 + 复盘",不是"教程"**。

主要写什么

  • 生产事故复盘 — 凌晨三点那种,附带时间线、根因、Action Items
  • 性能调优 — Nginx / Linux 内核 / 数据库参数的真实数据
  • 工具使用 — Ansible / Prometheus / 各种 iostat / ss / tcpdump 的实战
  • 工程实践 — 监控告警、值班 SOP、灰度发布、容量评估

不写什么

  • 不写"5 分钟学会 Kubernetes"这种标题党
  • 不写只在大厂能用的方案(不切实际)
  • 不写未经生产验证的"最佳实践"

技术栈

本站用纯 HTML/CSS/JS 写成,无任何前端框架、无构建工具。Markdown 文章通过 marked.js 解析,代码高亮用 highlight.js。全文搜索是 自己写的一个简单的关键词匹配(数据集小,不需要 Fuse.js)。

联系我

欢迎邮件交流技术问题、博客勘误、或者你遇到的生产事故:

关于留言

本站默认不挂评论系统。如果想交流,最直接的方式是邮件。 当然,也欢迎在 GitHub 仓库提 Issue——博客源码我也会开源。