About
关于这个站
一个 SRE 的工作笔记、生产事故复盘、和一些乱糟糟的折腾记录。
你好,欢迎来到运维手记。这里主要记录我在 Linux 运维、Kubernetes、性能调优、监控告警、故障排查等领域的实战经验。 写给同样在生产环境里摸爬滚打的同行。
我 2018 年入行,从基础的服务器运维开始,后来转 SRE 方向。 这些年踩过的坑比写过的代码多,**所以这个博客里大部分是"踩坑 + 复盘",不是"教程"**。
主要写什么
- 生产事故复盘 — 凌晨三点那种,附带时间线、根因、Action Items
- 性能调优 — Nginx / Linux 内核 / 数据库参数的真实数据
- 工具使用 — Ansible / Prometheus / 各种 iostat / ss / tcpdump 的实战
- 工程实践 — 监控告警、值班 SOP、灰度发布、容量评估
不写什么
- 不写"5 分钟学会 Kubernetes"这种标题党
- 不写只在大厂能用的方案(不切实际)
- 不写未经生产验证的"最佳实践"
技术栈
本站用纯 HTML/CSS/JS 写成,无任何前端框架、无构建工具。Markdown 文章通过
marked.js 解析,代码高亮用 highlight.js。全文搜索是
自己写的一个简单的关键词匹配(数据集小,不需要 Fuse.js)。
联系我
欢迎邮件交流技术问题、博客勘误、或者你遇到的生产事故:
关于留言
本站默认不挂评论系统。如果想交流,最直接的方式是邮件。 当然,也欢迎在 GitHub 仓库提 Issue——博客源码我也会开源。