什么是Hudi

发布于:2023-08-26 21:23:06

Hudi (胡迪)

Apache Hudi是一个Data Lakes的开源方案,Hudi是Hadoop Updates and Incrementals的简写,它是由Uber开发并开源的Data Lakes解决方案。Hudi能够基于HDFS之上管理大型分析数据集,可以对数据进行插入、更新、增量消费等操作,主要目的是高效减少摄取过程中的数据延迟。

Hudi非常轻量级,可以作为lib与Spark、Flink进行集成,Hudi官网:

https://hudi.apache.org


https://zhuanlan.zhihu.com/p/524699091

c75d4b94fe30c2e73d0b7fc2f01383cd.png

阅读 132+

一片空白

父爱如山,不善表达。回想十多年前,总记得父亲有个宽厚的肩膀,小小的自己跨坐在上面,越过人山人海去看更广阔的天空,那个时候期望自己有一双翅膀,能够像鸟儿一样飞得高,看得远。虽然父亲有时会和自己开玩笑,但在做错事的时候会受到严厉的训斥。父亲有双粗糙的大手掌。