博客
MySQL 学习笔记:SQL 复习、原理与优化
2022 年学习 MySQL 的三篇笔记(SQL 语法复习、MySQL 原理、MySQL 优化)合并整理。原理先行,实践在后。
Redis 学习笔记:概念、持久化与底层
2022 年学习 Redis 的两篇笔记(浅谈 Redis 中间件、深入理解 Redis 底层)合并整理。教程来源于 b站狂神说 Java 的 Redis 教程,底层部分配图主要来自极客时间。
大数据与中间件组件部署总览
本文汇总 HDFS、YARN、Hive、Spark、Flink、Zookeeper、Kafka、MySQL、Redis、Nacos、RocketMQ 共 11 个组件的安装部署文档,统一了目录导航,便于对照查阅。各组件更深入的生产调优(8C16G / 32C256G / 64C512G…
DataSophon 部署大数据组件:参数说明与优化实践
本文基于本地源码工程(datasophon,2.0.0 分支,对应 datasophon-api/src/main/resources/meta/DDP-2.0.0)梳理 DataSophon…
本地 DataSophon 与开源增强版对比及升级思路
上一篇《DataSophon 部署大数据组件》基于本地私有工程(2.0.0)。本文将其与 GitHub 公开仓库 88fantasy/datasophon(3.0-SNAPSHOT,深度定制分支)做全面对比:技术栈、通信架构、组件清单、参数模型,并给出"要不要升、怎么升"的决策与迁移思路。
Flink 生产调优实践
Flink 调优的核心矛盾是内存三分(JVM 堆、托管内存、堆外)与状态后端(RocksDB 还是堆内)的选择,其次是并行度与检查点的节奏。调优目标是:作业吞吐稳定、故障秒级恢复、不丢数据。部署安装见《大数据与中间件组件部署总览》。
HDFS 生产调优实践
HDFS 的调优思路只有一条主线:NameNode 是瓶颈,DataNode 是 IO。NameNode 吃内存(元数据全在堆里),DataNode 吃磁盘与网络。所以调优时先算两笔账:集群的块数决定 NameNode…