数据中心

NVMe 存储协议深度实战:从 SQ/CQ 环形队列到多队列并行 I/O 调度架构

深度解析 NVMe(Non-Volatile Memory Express)存储协议完整技术栈:从 SQ/CQ 环形队列机制、Doorbell 寄存器、MSI-X 中断,到多队列并行 I/O 调度、Namespace 管理、ZNS/KV 等扩展命令集。涵盖 SPDK 用户态驱动实现、PRP/SGL scatter-gather DMA 映射、Controller 初始化流程,以及 NVMe over Fabrics 的 RDMA/TCP 传输层架构。

TCP BBR 拥塞控制算法深度实战:从带宽感知模型到 BBRv2 多流公平竞争的工程演进

深度解析Google TCP BBR拥塞控制算法的完整工程实现——BBRv1两大核心参数(RTprop与BtlBw)测量模型、四状态状态机(Startup/Drain/ProbeBW/ProbeRTT)的数学原理与参数调优、与CUBIC/RED/ECN等传统loss-based算法的本质差异与实测对比、BBRv2引入ECN信号与loss信号解决多流公平性问题的演进路线、Linux 4.9+ tcp_bbr内核模块源码级解析(btl_bw_filter、min_rtt_tracking、pacing_rate计算)、以及生产环境数据中心/视频推流/广域网加速的调优实践。

Linux内核TCP拥塞控制算法深度实战:从Reno/CUBIC到BBR/v3全解与生产调优指南

从TCP拥塞控制基础理论出发,深入剖析Linux内核中的Reno/CUBIC/BBR三代算法实现:拥塞窗口动态、丢包模型vs延迟模型、CUBIC三次函数增长曲线、BBR带宽与RTT探测机制、BBRv2/v3对ECN和丢包的响应、/proc/sys/net/ipv4/tcp_congestion_control配置、eBPF拥塞控制扩展、生产级场景选择策略。

CXL (Compute Express Link) 内存池化与分层架构深度工程

CXL (Compute Express Link) 深度工程全解析:从协议架构(CXL.io/cache/mem三种子协议、Type1/2/3设备类型)到Linux内核子系统实战(内存区域配置、cxl-cli工具链、NUMA分层管理),涵盖CXL 3.0 Shared Memory与Fabric拓扑、PBR路由协议、与RDMA/NVMe的性能对比(延迟约300ns vs 1-5μs vs 10-100μs),以及大模型推理混合内存架构实战部署。