
运维日志
专注 Linux 系统运维与数据库运维技术分享,记录踩坑经验,沉淀最佳实践。
最新文章
查看全部 →

一台机器被一个进程拖垮:用 cgroup v2 和 systemd 把它关进笼子
凌晨两点,一台共用机器 load 飙到 80,SSH 都卡。查下来是个批处理脚本 fork 爆炸,把整台宿主的 CPU 和内存吃光。这种「一个进程搞死全机」的事,ulimit 管不住、nice 降优先级也只是缓解。真正的答案是 cgroup v2——配合 systemd 的 resource control,给每个服务画好 CPU、内存、IO 的硬边界,谁越界谁先死,绝不连累邻居。

PostgreSQL 表膨胀治理:MVCC 死元组和 autovacuum 调优实战
PG 跑几个月后表体积翻了好几倍、查询越来越慢,但数据量没怎么涨——多半是 MVCC 死元组没清掉,表膨胀了。讲清死元组怎么来的、怎么量化膨胀率、autovacuum 为什么没跟上,以及手动 vacuum / 重建表 / 参数调优的具体操作,附我线上踩过的坑。


给千万行大表加字段不锁表:pt-online-schema-change 与 gh-ost 实战
一张 5000 万行的订单表要加个索引,直接 ALTER 一跑,写入全卡、连接堆成山、从库延迟飙到几分钟——这是每个 DBA 都挨过的打。MySQL 8.0 的 ALGORITHM=INSTANT 覆盖不了所有场景,真要大表变更得靠 pt-online-schema-change 和 gh-ost 这类影子表工具。一个用触发器、一个靠 binlog,把两条路都跑通,连同坑点一起摊开。

Too many open files:ulimit、LimitNOFILE 与 fd 泄漏的完整排查链路
服务半夜开始报错 accept4() failed (24: Too many open files),或者 Nginx 频繁 502。这种故障十次有八次是文件句柄(fd)耗尽,但光改 ulimit -n 往往没用——因为 systemd 起的服务根本不吃 limits.conf 那套。从内核 file-max 到进程 LimitNOFILE,到定位到底是哪个进程在漏 fd,把每一层都讲透,并给出不停机临时救急和永久修复两条路。
会员管理系统
FREE支持定制完全免费的会员管理系统,开箱即用。 支持会员信息管理、积分体系、消费记录等核心功能。 接受定制化开发 —— 无论你需要接入微信支付、定制报表、还是对接现有ERP系统,都可以按需开发,交付源码。