ETL工程师-面试

发布时间：2024年01月16日

1.自我介绍

2.数据流程

3.说下自己写过的脚本

4.关于hive提问

? ? 4.1 如何把服务器中的数据上传到hive表里面

? ? 4.2 hive中的一个表分区的数据怎么导入到另一个表中的分区中。

? ? 4.3? 如果一个字段不为空，取空值，如果字段为空，取默认值

? ? 4.4 udf, udtf使用场景

5.Flink的数据一致性

? ?Flink中在kafka中数据重新再写回到kafka里面有什么好处。

6.项目中为什么使用orc和snappy？对比其他的存储算法，有什么好处。

7.你们是自己做运维的吗，集群中出现一些问题，该如何解决。

总结----

? ? 面试过程中出现了一些卡顿，主要是场景题时。

文章来源:https://blog.csdn.net/qq_44835418/article/details/135618982
本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若内容造成侵权/违法违规/事实不符，请联系我的编程经验分享网邮箱：chenni525@qq.com进行投诉反馈，一经查实，立即删除！