Posts
All the articles I've posted.
-
MySQL 内核 · 主从复制与高可用
MySQL 内核收官:binlog 复制链路、异步与半同步、并行复制与主从延迟、MHA/MGR 与读写分离,落到写后读一致性与配置投放正确性。
-
特征构建:切配、换角度、片下部位——把原始料做出新味道
「数据与特征工程系列」第 4 篇:特征构建的三条路——特征组合(GBDT+LR 叶子编码、特征搜索、CTR 交叉特征内积)、映射到新空间(FFT / 小波 / 数据熵)、衍生变量(泰坦尼克号 Name/Cabin/Ticket 拆解)。附多重共线性的坑与规避。
-
数据预处理:洗菜择菜的三步——观察、清洗、整理
「数据与特征工程系列」第 3 篇:把原始数据变成干净规整数据集的三步——数据观察(系统地找问题)、数据清洗(异常值检测:箱线图 / 切比雪夫 / 孤立森林,缺失值四种补法)、数据整理(标准化 / 归一化 / 鲁棒缩放)。
-
MySQL 内核 · 执行计划与慢查询优化
MySQL 内核第四篇:EXPLAIN 读法、优化器如何选索引、索引失效与 JOIN 算法、深分页优化与慢查询治理,落到报表慢查询与配置库性能边界。
-
特征工程系统化框架:能用哪些料、料从哪进、料坏了怎么报警
「数据与特征工程系列」第 2 篇:用「后厨的三张清单」拆解一套工业级特征体系——特征使用方案(选哪些料 + 可用性评估)、特征获取方案(离线/在线分层获取)、特征监控方案(时效性/覆盖率/异常值 + 有效性分析 + 降级闭环),全程用美团点击下单率预估做实例。