后端与分布式
这块面试考什么
- 数据管道与 Kafka:说明数据管道要连接哪些环节,解释 Kafka 的组成以及各部分在消息流转中的作用。
- 消息发送、保存与读取:沿着生产端、消息服务和消费端追踪数据,讲清消息如何进入系统、保存并被读取。
- 集群与监控:说明集群、客户端和主题的配置关系,讨论发送与消费数据时如何查看运行指标。
- Spark 的计算流程:解释 Spark 的基本概念,描述数据处理的执行过程,以及应用如何在集群上运行。
- 分布式存储与文件格式:比较 HDFS 与相关文件格式的使用方式,说明 Hive、Presto 如何参与数据查询。
- 数据表的读写:讲清远程环境访问、数据库和表的创建、数据写入及交互查询这些环节如何衔接。
- 流式数据处理:说明持续到达的数据怎样进入计算过程,解释 Structured Streaming 的基本概念与执行流程。
- 推荐与热点分析案例:用电影推荐和热门话题场景串起数据输入、计算与存储,解释系统各环节的职责。
用 GoInterview 怎么练
- 听清技术追问:模拟面试时由同伴通过会议软件追问消息链路或存储选择;GoInterview 可捕获系统声音,实时转写对方提问。
- 把数据流程讲清楚:建议显示在独立提示面板里。练习时参考答话思路,自己按发送、存储、消费或计算的顺序讲述数据流程。
- 练英文后端讨论:听题语言与答话语言可分开设置,用英文练习解释消息队列和数据处理流程,界面可保持中文。
想要真人带
想要真人老师带着练后端与分布式?可以看看上岸算法的相关内容。