ETL工程师-面试

发布时间:2024年01月16日

1.自我介绍

2.数据流程

3.说下自己写过的脚本

4.关于hive提问

? ? 4.1 如何把服务器中的数据上传到hive表里面

? ? 4.2 hive中的一个表分区的数据怎么导入到另一个表中的分区中。

? ? 4.3? 如果一个字段 不为空,取空值,如果字段为空,取默认值

? ? 4.4 udf, udtf使用场景

5.Flink的数据一致性

? ?Flink中在kafka中数据重新再写回到kafka里面有什么好处。

6.项目中为什么使用orc和snappy? 对比其他的存储算法,有什么好处。

7.你们是自己做运维的吗,集群中出现一些问题,该如何解决。

总结----

? ? 面试过程中出现了一些卡顿,主要是场景题时。

??

??

文章来源:https://blog.csdn.net/qq_44835418/article/details/135618982
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。