Apache 生态

面向生产规模的开源基础设施。

我的开源工作关注能够支撑真实生产规模的数据基础设施。

长期主线

我的 Apache 工作从 HBase、Hadoop 时代的大数据存储基础设施,逐步延展到 Flink 状态后端、湖格式、远程 Shuffle、执行加速以及 AI 时代的数据系统。贯穿其中的主线,是把技术深度、社区治理和真实生产负载下的可靠性结合起来。

Apache 角色

ASF Member

2021 年成为 ASF Member,持续参与 Apache 社区与 ALC Beijing 相关活动。

PMC Member

Apache Flink、HBase、Paimon、Celeborn、Gluten、Fluss;HBase Committer 与 PMC 工作始于 2016 年。

Champion

Apache Paimon、Apache Celeborn、Apache Fluss 孵化阶段 Champion。

Mentor

Apache Amoro、Apache GraphAr Mentor。

Apache 时间线

开源生态图谱

层次Apache 项目阿里云产品状态
流式存储FlussStreaming Storage for Apache Fluss*TLP
湖格式PaimonMilvus x DLF Vector LakeTLP
湖仓管理AmoroDLF*孵化中
Shuffle 服务CelebornEMR Fusion for Apache SparkTLP
批执行GlutenFusion KernelTLP
OLAPDoris*EMR StarRocks / Stella Kernel相关生态
流计算FlinkRealtime Compute for Apache Flink*TLP
NoSQLHBaseEMR on ECS DataServingTLP
向量数据库Milvus

带 * 的条目是相邻生态参考,不代表我直接参与的项目或负责的产品。