🐧

运维日志

专注 Linux 系统运维与数据库运维技术分享,记录踩坑经验,沉淀最佳实践。

最新文章

查看全部 →
单库跑着不算保险:用 Oracle 19c Data Guard 物理备库扛住主机房塌了
数据库运维12 min read

单库跑着不算保险:用 Oracle 19c Data Guard 物理备库扛住主机房塌了

RMAN 备份恢复写过,日常运维也写过,但这篇讲另一件真出事才显价值的事——给 Oracle 19c 建一套物理备库。主机板子烧了、机房网络断了,有 DG 你一条命令切过去继续跑;没有,就只能从备份恢复, downtime 和数据丢失都够喝一壶。从前置条件、RMAN 复制建库、broker 配置到 switchover/failover 和那些必踩的坑,这篇都给你敲出来。

透明大页不是免费午餐:THP 怎么把数据库延迟搞出毛刺,以及几种靠谱的关法
Linux运维11 min read

透明大页不是免费午餐:THP 怎么把数据库延迟搞出毛刺,以及几种靠谱的关法

有段时间 Redis 每隔几秒就冒一次百毫秒级的延迟尖刺,CPU 闲着、慢日志干净、大 key 也查不出来。最后定位到不是程序也不是网络,是内核在后台帮我们「好心」合并大页。这篇文章从一次真实的毛刺排查讲起,说清 THP 到底是啥、为什么延迟敏感的服务最怕它、怎么确认它在捣乱,以及临时关、systemd 关、grub 关、容器里关各自怎么落地、踩过哪些坑。

Oracle 19c 装完能连只是开始:表空间、内存、AWR 和那些半夜弹出来的 ORA 报错
数据库运维13 min read

Oracle 19c 装完能连只是开始:表空间、内存、AWR 和那些半夜弹出来的 ORA 报错

RMAN 备份那套另写过,这篇只讲上线之后每天真会撞上的事:表空间悄悄涨满、业务喊慢你却不知道慢在哪、ORA-01555 和 ORA-00257 半夜报警、还有一句 ALTER SYSTEM KILL SESSION 救活被锁死的接口。不堆概念,给能直接敲的命令、能看懂的判断,以及我踩过的几个弯。

把几块盘拼成一块放心盘:mdadm 软 RAID 的创建、换盘与重建监控
Linux运维14 min read

把几块盘拼成一块放心盘:mdadm 软 RAID 的创建、换盘与重建监控

有人觉得有了 ZFS 和 LVM 就不需要 mdadm 了,可真到给一台老服务器加两块盘做镜像、或者把一组 SATA 盘凑成读写盘的时候,mdadm 还是最顺手的那一个。这篇文章不堆概念,直接讲怎么从零建 RAID、盘坏了怎么热替换、重建进度怎么盯,以及那些文档不会告诉你的坑——比如 RAID5 掉盘重建时第二块盘也读不出、bitmap 没开导致重建慢一倍、还有 RAID 永远不是备份这件事。

Redis 重启即失?RDB、AOF 与混合持久化,以及断电后怎么把数据救回来
数据库运维13 min read

Redis 重启即失?RDB、AOF 与混合持久化,以及断电后怎么把数据救回来

Redis 默认纯内存,进程一退数据全没。RDB 快照、AOF 日志、Redis 4.0 起的混合持久化,三者取舍和坑点远比「开个 AOF」复杂:fork 内存翻倍、AOF 重写期间丢数据、文件损坏启动不了、FLUSHALL 后怎么抢时间救。从一次断电复盘讲起,把配置、取舍、崩溃恢复和运维观测拆开说。

kill 不掉、defunct 堆满:进程信号与僵尸回收这件常被误判的事
Linux运维13 min read

kill 不掉、defunct 堆满:进程信号与僵尸回收这件常被误判的事

kill -9 把进程干不掉,ps 里却还挂着一行 defunct——这类现象八成被错怪成「服务僵死」。从一次凌晨告警讲起,把信号到底是什么、为什么 -9 也会失效、僵尸进程怎么定位又该怎么回收讲透,顺带把 D 状态、孤儿进程、systemd 的信号投递这几个真正容易踩的点拆开。

会员管理系统

FREE支持定制

完全免费的会员管理系统,开箱即用。 支持会员信息管理、积分体系、消费记录等核心功能。 接受定制化开发 —— 无论你需要接入微信支付、定制报表、还是对接现有ERP系统,都可以按需开发,交付源码。

Web端管理后台会员信息管理积分系统消费记录数据导出定制化开发交付源码
了解更多

热门标签

专栏分类