调度器

Linux 内核 CFS 调度器深度工程实战:从 vruntime 计算到 NUMA 感知调优的全栈解析

深度剖析 Linux 内核 CFS(完全公平调度器)全栈架构:从 vruntime 与最小粒度时间片的设计哲学、红黑树 O(log n) 选取、update_curr 运行时统计、sysctl_sched_latency/min_granularity/wakeup_granularity 三大核心参数调优、load_balance 跨核迁移算法、SCHED_FIFO/RR/DEADLINE 实时策略差异,到 NUMA 拓扑感知的调度域层级与 sched_setaffinity 绑核实战。含 cgroup v2 cpu controller 与生产环境基准测试。

Ray 分布式计算引擎深度实战:从 Plasma 共享内存对象存储、Actor 所有权模型到 GCS 与分布式调度的工程全解

深入解析 Ray 分布式计算引擎三大基石:基于 Arrow 与共享内存的 Plasma 对象存储、所有权模型下的分布式引用计数与血缘重建容错、刻意保持轻薄的 GCS 控制面,以及自下而上的分布式调度与 Placement Group 资源预留。配合可运行代码与生产踩坑清单。

Apache Airflow 调度器深度实战:从 DAG 序列化、Critical Section 到 Deferrable Operator 与 Asset 驱动调度的工程全解

拆解 Airflow 2.x 调度器的核心工程取舍:Serialized DAG 如何把 Python 对象砍出决策链路,Critical Section 行锁如何保证 Pool 额度扣减的原子性,Deferrable Operator 如何消灭 Sensor 的 slot 空转,Asset 又如何把调度从时间驱动升级为数据驱动。附生产调优清单与可直接落地的自定义 Trigger 代码。

Linux内核NUMA调度与内存管理深度实战:从First-Touch陷阱到容器NUMA对齐全指南

深入解析 Linux 内核 NUMA 软硬件全栈:NUMA 架构演进与拓扑(ACPI SLIT/距离矩阵)、sched_domain 层级调度域(MC/PKG/Node/FullSystem)、Automatic NUMA Balancing 完整工作流程(扫描→Fault→决策→迁移)、mempolicy 四大策略(Default/BIND/PREFERRED/INTERLEAVE)与 First-Touch 陷阱、巨页与 NUMA(THP/khugepaged/hugetlbfs)、容器 NUMA 感知(cgroup v2/Topology Manager/libvirt vCPU绑核)、生产诊断工具(numastat/perf c2c/Uncore PMU/eBPF)、Redis/数据库/AI 训练 NUMA 优化案例。