OLAP

DuckDB 查询执行引擎深度实战:从 Vector/DataChunk 内存布局到推送式 Pipeline 与并行聚合的工程全解

深入拆解 DuckDB 查询执行引擎:Vector/DataChunk 的五种向量形态与 UnifiedVectorFormat 归一化、selection vector 零复制过滤与自适应过滤器重排、从火山模型到推送式 Pipeline 的架构重构、Local/Global 状态分离的 radix 分区并行聚合,并给出生产级参数配置与性能调优实战观点。

DataFusion: Rust 原生查询引擎深入工程

深入剖析 Apache DataFusion——用 Rust 编写的高性能查询引擎,涵盖其架构设计、优化器实现、流式执行模型、内存管理、Join 算法以及在生产环境中的工程实践。