
【阿里】维度建模:星型模型与雪花模型怎么选
阿里数仓实习一面真题。维度建模以业务过程和一致性维度为骨架,星型模型查询简单性能好,雪花模型规范化省存储,实践中星型为主、局部雪花。

阿里数仓实习一面真题。维度建模以业务过程和一致性维度为骨架,星型模型查询简单性能好,雪花模型规范化省存储,实践中星型为主、局部雪花。

京东大数据开发一面真题。Flink 算子分转换、分区、聚合、关联几类,窗口覆盖滚动/滑动/会话/全局四种,附 Window API 与事件时间触发要点。

京东大数据开发一面真题。ClickHouse 读快靠列存+向量化+稀疏索引+数据分区裁剪,写快靠追加写 parts+异步 merge 的 LSM 类机制。

京东大数据开发一面真题。以电商实时数仓为例讲清 Kafka 分层、Flink 加工、ClickHouse/Doris 服务的架构全貌,以及每个选型背后的理由。

阿里数仓实习一面真题。重复来自生产者重试、消费者位移提交与 rebalance 两个方向;项目里用幂等生产者、手动位移提交、下游幂等去重三板斧应对。

阿里(飞猪数据团队)数仓实习一面真题。主题域是面向分析的业务视角,数据域是面向建设的加工视角,两者解决的是分类和归属两个不同问题。

阿里数仓实习一面(飞猪数据团队)真题。分层带来复用、口径统一、隔离变化和问题定位四大收益;最难的是 DWS,难在公共沉淀的粒度与边界拿捏。

阿里云大数据开发三面真题。两者都是分布式计算体系,Hadoop 提供存储+调度+批处理全家桶,Spark 以内存迭代计算和统一栈见长,实际生产中互补共存。

字节跳动大数据一面真题。HDFS 写流程的 pipeline 复制机制、机架感知副本放置,以及 NameNode 单点问题的 HA 方案与 Federation 扩展。

字节跳动大数据一面真题。Broadcast Hash、Shuffle Hash、Sort Merge 三种 join 的执行原理、触发条件与调优参数,结合数据量级讲清怎么选。