向量化执行

DuckDB 查询执行引擎深度实战:从 Vector/DataChunk 内存布局到推送式 Pipeline 与并行聚合的工程全解

深入拆解 DuckDB 查询执行引擎:Vector/DataChunk 的五种向量形态与 UnifiedVectorFormat 归一化、selection vector 零复制过滤与自适应过滤器重排、从火山模型到推送式 Pipeline 的架构重构、Local/Global 状态分离的 radix 分区并行聚合,并给出生产级参数配置与性能调优实战观点。

Apache Calcite 查询编译框架与 Hive 执行引擎深度工程实战:从 SqlNode 校验、Volcano/Cascades 规划器、RelTrait 与 Convention 传播、物化视图改写、Rex 表达式化简到 Hive Tez DAG 与向量化执行的全链路解析

拆解现代 SQL 引擎的公共骨架:Calcite 的四阶段流水线、RelNode/RexNode 二分建模、Volcano 与 Hep 两套规划器的分工、Trait/Convention 如何支撑跨引擎物理实现、SubstitutionVisitor 与 UnifyRule 的物化视图改写机制,以及 Hive 如何把 RelNode 落到 Tez DAG、VectorizedRowBatch 与 LLAP,并给出生产调优清单。

从零构建列式查询引擎:内存格式、向量化执行与 Rust 工程实践

从零构建列式查询引擎的完整工程实践:深入剖析列式存储原理、Apache Arrow内存格式字典编码、查询编译流水线谓词下推、向量化执行引擎批量处理模式、SIMD加速过滤与聚合、高性能内存分配器与缓冲区池、io_uring异步IO集成、并行执行调度策略、Spill to Disk溢出处理,以及基于Prometheus的生产监控体系