跳到主要内容

2026

72 篇文章
所有标签

浏览此标签下的所有文章

2026-08-21
1728 字 · 8 分钟

DataX 适配 Kerberos Hadoop/Hive 集群:从 hdfsreader 到 hdfswriter 的踩坑实录

上一篇博客讲了 DolphinScheduler 怎么接入 Kerberos 认证的 Hive(数据源配置层面)。这次继续往链路深处走:调度平台里的 DataX 任务要真正读写 Kerberos 集群的 HDFS/Hive,官方开源版 DataX 直接跑不通,本文记录从 hdfsreader 读到…

2026-08-21
3552 字 · 16 分钟

DolphinScheduler 接入 Kerberos 认证 Hive:从 KDC 到数据源测试连接

一篇讲透 DolphinScheduler 接 Kerberos Hive 的全链路:底座怎么开 Kerberos、凭据怎么分发到调度节点、数据源表单里 principal / keytab / other…

2026-08-20
5133 字 · 19 分钟

FDE(前向部署工程师)岗的核心学习方法

本文以「FDE(Forward Deployed Engineer,前向部署工程师)」为目标岗位,沿用《Agent Harness 岗的核心学习方法》的调研方法,对 Palantir、OpenAI、Anthropic、Google Cloud、Databricks、Scale AI…

2026-08-14
1606 字 · 6 分钟

博客写作与维护规范(项目常规操作)

2026-08-13 发布的两篇求职分析文章在复盘时暴露了三类问题:时间先后不一致、内容重复、语句不通顺。修订完成后,我把这类问题固化为本博客项目的常规操作要求,作为每篇文章发布前的自检清单。

2026-08-14
4805 字 · 18 分钟

Agent Harness 岗的核心学习方法

本文以 DeepSeek Harness 团队「Agent Harness 研发/工程方向」为目标岗位,通过对 bilibili 视频课程与 GitHub 开源项目的调研总结,系统阐述如何训练 Agent 开发与 Harness…

2026-08-13
2800 字 · 10 分钟

DeepSeek 研发岗位全量扫描与自我匹配评估

本文对幻方&DeepSeek 招聘官网全部在招岗位做全量扫描——排除产品与职能部门后,对 21 个研发/技术岗位逐一打分排序,并给出投递策略。单个岗位的逐条分析(Agent Infra)见上一篇:DeepSeek「Agent Infra 研发工程师」岗位分析与自我匹配评估。

2026-08-13
3209 字 · 12 分钟

DeepSeek「Agent Infra 研发工程师」岗位分析与自我匹配评估

岗位链接:幻方&DeepSeek 社会招聘 - Agent Infra 研发工程师

2026-08-11
3089 字 · 22 分钟

C++ STL 容器学习笔记

2020-2021 年算法刷题时期学习的 C++ STL 容器笔记(map、priority_queue/multiset、unordered_map、unordered_set)合并整理。除了 bitset、priority_queue(堆)以及…

2026-08-11
2434 字 · 9 分钟

企业级大数据底座技术架构与未来迭代思路

上一篇对比了本地 DataSophon(2.0.0)与开源增强版(3.0-SNAPSHOT)的差异。本文跳出版本之争,回答一个更本质的问题:当前企业级大数据底座的技术架构长什么样?未来 3-5 年产品如何迭代?是继续在 DataSophon 上投入,还是走所谓的技术转型?

2026-08-11
1372 字 · 6 分钟

Doris 原理、部署与调优指南

Doris 是 MPP(Massively Parallel Processing,大规模并行处理)分析型数据库,定位"在线报表 + 实时分析",主打高并发点查与多表 Join。本文覆盖底层原理、集群部署(FE/BE)、参数优化与常见问题,作为湖仓时代 OLAP 引擎的第一块拼图。