用 153 本极客时间电子书,搭一条 6 周的 Elasticsearch 上手路径
【免费下载链接】geektime-books:books: 极客时间电子书项目地址: https://gitcode.com/GitHub_Trending/ge/geektime-books
Elasticsearch 集群里 2 亿条订单索引的 P99 查询从 180ms 涨到 3s,你手里只有官方文档和零散笔记。geektime-books 仓库收录 153 本极客时间电子书,覆盖检索、存储、分布式、性能四个方向,正好补齐这条 Elasticsearch 学习路径。
仓库速览
仓库地址:git clone https://gitcode.com/GitHub_Trending/ge/geektime-books,拉下来即读。共 153 本 epub,编号 01~199,从数据结构、数据库、中间件到性能调优、架构管理都有。技术线完整:检索、存储、消息队列、分布式、JVM、系统性能六个方向各有一本主读书。适合想从零搭搜索能力、或从后端转搜索方向的工程师,当工具书库按编号查着读,不必通读。
📖 分阶段书单:入门 → 进阶 → 优化
入门:先懂检索,再碰 ES
- 123-检索技术核心20讲.epub:倒排索引、BM25 打分、查询解析的 20 讲,是 ES 的底层原理,读完能解释"为什么这条结果排第一"。
- 06-MySQL实战45讲.epub:索引与执行计划的 45 个场景,读懂后 ES↔MySQL 双写、补数和一致性问题才不会做错。
进阶:数据怎么进 ES
- 46-Kafka核心技术与实战.epub:binlog→Kafka→ES 是主流同步形态,这本书补齐队列语义、消费组与 lag 监控部分。
- 90-分布式技术原理与算法解析.epub:分片、副本、主节点选举都靠共识与一致性模型,读完 ES 集群的故障行为不再是黑盒。
- 36-大规模数据处理实战.epub:1 亿行订单全量补数时的 ETL 拆分与限速策略,出自这里。
优化:让集群撑住流量
- 12-Linux性能优化实战.epub:磁盘 IO、fsync、swappiness 都是操作系统层问题,这本书是机器侧的排查清单。
- 08-深入拆解Java虚拟机.epub:ES 节点是 JVM 进程,GC 与堆行为是搜索毛刺的最常见原因,读后能自己定 -Xms=-Xmx。
- 190-容量保障核心技术与实战.epub:扩容前先压测和降级演练,容量规划方法论在这本里。
🛠 6 周动手计划:每周有可验收的产出
- 第 1-2 周 · 环境与基线:clone 仓库,装一个 ES 8.x 单节点,读完 123 的前 5 讲。验收:建成 1 亿行订单测试索引,单字段 term 查询 P99 < 50ms。产出:一页基线报告(文档数 / 分片数 / P99 / bulk 吞吐)。
- 第 3-4 周 · 同步链路:搭 MySQL→Kafka→ES 链路,边搭边读 46。验收:同步 lag P95 < 5s,抽 200 条与库端逐字段一致。
- 第 5 周 · 故障演练:起 3 节点集群,杀掉 1 个数据节点。验收:分片恢复 < 5 分钟,主节点切换期间写入不丢。
- 第 6 周 · 慢查询分析:用 _profile 接口拉出 Top3 慢查询,对照 12 和 08 定位。产出:调优清单,至少 3 条(mapping 调整 / 堆参数 / 查询改写)。
🧭 三个高频坑,和社区入口
- "装完 ES 就能用,不看 mapping"——keyword 和 text 选错,1 亿行数据要重建索引,写数据前先确认 mapping。
- "堆给得越多越好"——ES 堆上限 31G(压缩指针),超过反而变慢。
- "拿 ES 当主存储"——ES 是搜索索引,主存留在 DB,否则恢复与一致性代价扛不住。
社区入口:官方参考手册(elastic.co 官方文档站搜 "Elasticsearch Reference")、官方论坛 discuss.elastic.co;仓库内 README.md 加 153 本编号书就是最直接的索引。
下一步行动
本周:clone 仓库,把单节点 ES 跑起来,读完 123 的前 5 讲。 下周:把 1 亿行测试索引跑出来,写出第一份基线报告。 卡住时回到书单按方向找书,6 周计划只需要上面 8 本。
【免费下载链接】geektime-books:books: 极客时间电子书项目地址: https://gitcode.com/GitHub_Trending/ge/geektime-books
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考