Shuffle 优化 YARN 工作机制 本文梳理 Hadoop MapReduce Shuffle 全流程(Map 溢写排序/合并、Reduce 拉取归并聚合),并给出缓冲区、Combiner、并行拉取与压缩等优化点;同时介绍 YARN 组件与调度器、多队列优势、Benchmark 测试,以及宕机、数据倾斜与资源分配问题的排查方案。 数开知识点 #Hadoop 2025-10-27 66 0
HDFS_读写流程笔记 本文梳理 Hadoop/HDFS 常用端口与核心配置文件作用,详解 HDFS 文件写入(副本分配、管道传输与确认)和读取(就近访问、故障切换)流程,并总结小文件问题危害及 HAR、合并输入、JVM 重用等优化策略与面试要点。 数开知识点 #Hadoop 2025-10-27 65 0
📘 数据仓库建模与维度建模笔记 笔记梳理数据仓库建模意义,比较 Inmon 的 ER 与 Kimball 维度模型;详解事务/周期快照/累积快照三类事实表及可加性;总结维度表设计、星型/雪花模型,以及慢变维快照与拉链表处理。 项目实战🖨️ #电商数仓🧰 2025-10-24 49 0
睡眠质量难得上90分😙 作者分享近期睡眠状态变好:自6月戴手表以来仅3次睡眠质量超过90分,最近两天都达标。虽然昨晚吃肯德基后有点拉肚子,但“疯狂星期四”量确实很足,吃到后面都有些撑。 记录生活✍️ #日常record✍️ 2025-10-23 16 0
蠢蠢蠢 帮老师修电脑时发现系统和 Office 未激活,准备重装却屡次失败,还折腾着去激活系统。排查半天才发现安装界面漏勾选关键选项,勾上后立刻正常安装,白白浪费了一个半小时。 记录生活✍️ #吐吐槽🙃 2025-10-21 24 0
Week2_Day1_LeetCode - 数组 本文整理 LeetCode 数组三道高频题:最大子数组和用前缀和+贪心 O(n) 求解;合并区间先排序再扫描合并 O(nlogn);轮转数组用三次反转原地完成 O(n)、O(1) 空间,并给出 Python 实现与复杂度分析。 笔面算法🧐 #力扣Hot100🔥 2025-10-20 55 0
数据仓库 概念 架构 学习重点 梳理数仓:面向分析决策的多源历史数据系统;介绍ODS→ADS五层分层及采集、调度、可视化组件,区分离线/实时数仓,并给出建模、SQL、调度的学习顺序。 项目实战🖨️ #电商数仓🧰 2025-10-20 82 0
“及时拥有”是对努力的正向反馈 入手心心念念的 Pura 80,蹲到优惠全款拿下,丝绒绿虽偏淡但好看。出厂鸿蒙 5.1,部分应用未适配(如网易云需卓易通),已申请升级鸿蒙 6.0 尝鲜。整体纯血鸿蒙很丝滑,期待更多 App 适配与发布会新内容。 记录生活✍️ 2025-10-20 26 0
Week1_Day5_LeetCode 本文总结链表进阶三题:相交链表用双指针拼接遍历定位交点;环形链表II用Floyd快慢指针判环并求入环节点;合并两个有序链表用虚拟头节点+双指针归并,均为O(1)空间。 笔面算法🧐 #力扣Hot100🔥 2025-10-17 84 0
Week1_Day4_LeetCode - 链表 本文总结链表三题:反转链表(迭代三指针/递归)、回文链表(快慢指针找中点+反转后半对比)、环形链表(Floyd快慢指针判环并可求入口)。均为 O(n) 时间、O(1) 空间。 笔面算法🧐 #力扣Hot100🔥 2025-10-16 55 0