NUMA

Linux内核NUMA内存管理架构深度实战:从UMA/NUMA拓扑到自动均衡与性能优化全解

从UMA/NUMA统一内存架构演进出发,深入剖析Linux内核NUMA内存管理体系:pglist_data节点描述符、Zone分配器层级、free_area伙伴系统、Slab/SLUB/Per-CPU分配路径、四种内存策略语义与内核默认行为、Zone Reclaim模式、自动NUMA均衡(AutoNUMA)迁移机制、显式绑定API(mbind/set_mempolicy)、HugePage NUMA部署、性能基准实证,以及DPDK/AI训练等生产级调优模式。

Linux 进程调度器深度实战:从 CFS 完全公平调度器到 cgroup 资源隔离、实时调度策略、CPU 亲和性与生产级低延迟调优的完全工程指南

Linux 进程调度器深度实战完全指南:从 CFS 完全公平调度器红黑树与 vruntime 机制、SCHED_FIFO/SCHED_RR/SCHED_DEADLINE 实时策略、cgroup v2 CPU 带宽控制与 cpuset 绑定、CPU 亲和性与 NUMA 感知调度域、内核抢占模型(PREEMPT_NONE/VOLUNTARY/PREEMPT/RT)、中断亲和性、isolcpus 低延迟优化、taskset/cpuset、到 perf sched/bpftrace/ftrace/eBPF 调度器监控与生产级调优完全指南

Linux 内核 CXL 内存分层架构深度实战——从 CXL.io/cache/mem 协议栈到 Dynamic Capacity Device 与 Fabric 网络的内存解聚革命

深入剖析 CXL (Compute Express Link) 协议栈全景:从 CXL.io/cache/mem 三大子协议协同、Type 1/2/3/Switch 设备矩阵,到 Linux 内核 cxl_pci/cxl_mem/cxl_region 子系统架构、分层 NUMA 策略与 Soft Reserved 机制、DCD 动态容量热添加/移除、CXL 3.0 Fabric 网络与 Port Based Routing (PBR)。包含CXL 2.0 vs DDR5延迟带宽基准数据、AI训练内存扩展部署实践、MHD多Host共享内存场景,以及 ndctl/cxl-cli 完整工具链运维指南。

Linux内核Major Page Fault深度实战:TLB未命中、NUMA迁移与巨页优化的工程交响曲

承接《Linux内核内存管理深度实战》,深度拆解Major Page Fault的工程链路与优化:从TLB未命中、PCID/INVPCID、ASID硬件机制到内核handle_mm_fault核心路径;展现THP、AutoNUMA、1GB HugePage、NUMA硬绑定等的工程取舍模式;通过perf/bpftrace可观测性工具定位Major Fault来源,并提供生产环境尾延迟优化的四种完整方案。

CXL (Compute Express Link) 内存池化与分层架构深度工程

CXL (Compute Express Link) 深度工程全解析:从协议架构(CXL.io/cache/mem三种子协议、Type1/2/3设备类型)到Linux内核子系统实战(内存区域配置、cxl-cli工具链、NUMA分层管理),涵盖CXL 3.0 Shared Memory与Fabric拓扑、PBR路由协议、与RDMA/NVMe的性能对比(延迟约300ns vs 1-5μs vs 10-100μs),以及大模型推理混合内存架构实战部署。