分类
工作杂谈
Hive
Interview
数据仓库概念
Hadoop
Linux
技术
2026
【工作杂谈_20260901】数据监控:ADTK Python 项目搭建与验证
【工作杂谈_20260825】数据平台与工程治理: Benchmark 与 Baseline:从基准测试到生产基线
【工作杂谈_20260817】多维分析与数据建模: 维度上卷——从明细粒度到汇总层级
【工作杂谈_20260815】用户分析与身份体系: CanonicalUserId:从用户标识到身份图谱
【工作杂谈_20260810】用户分析与身份体系: Active User:定义、计算口径与常见应用
【工作杂谈_20260806】多维分析与数据建模: CROSS JOIN 实战:灵活生成多维聚合组合
【工作杂谈_20260731】数据平台与工程治理: MySQL 时区转换:UTC、北京时间与 PST/PDT 的对齐
【十二】Hive执行计划:EXPLAIN 输出与QueryPlan,EXPLAIN常见用法
【十一】HiveSQL底层执行过程:SQL 编译、任务生成与 YARN 调度流程
【二】HiveSQL 排名中取他值
【一】Hive表行列之间相互转换
【十】Hive 窗口函数:OVER / PARTITION BY / ORDER BY 与 OLAP 分析
Windows 使用 Docker Compose 搭建 Hive 4.1.0 + MySQL 持久化环境
【九】Hive 复杂数据类型:ARRAY / MAP / STRUCT 与嵌套展开
【八】Hive 计算引擎:MapReduce / Tez / Spark 对比与选型
【七】Hive 函数:聚合 / 统计 / 分位数 / 集合 / 高级分组
【六】Hive 运算逻辑:数学 / 逻辑 / 条件 / 日期 / 字符串函数
【五】Hive 存储格式与压缩
【四_(1)】Hive/Spark SQL 七种 JOIN 的区别:NULL 匹配规则与结果对比
【四】HiveSQL 语法大全
【三】Hive 抽样
【一】Hive数据类型
【二】Hive 分区与分桶
什么时候使用雪花模型
数据中台、数据仓库、大数据平台、数据湖概念区分
3、分布式计算 MapReduce & YARN
2、分布式存储 HDFS
2024
六、Linux 文件与目录管理
五、Linux 的文件权限与目录配置
Linux 基础入门
我的第一篇博客
↑
无法复制,本站文章内容受保护