使用主分片分配数据和工作,使用副本提供额外的数据副本和搜索能力。从工作负载和恢复需求出发,而不是寻找通用分片数量。
计算初始估算
假设主索引数据为 120 GB,测试表明每个主分片约 30 GB 适合当前负载:
text
120 GB / 30 GB = 4 primary shards
1 replica per primary = 4 additional shard copies
Total = 8 shard copies, roughly 240 GB of shard data
这些是假设的容量规划输入。存储估算不包含增长和运维空间,例如后台合并索引文件的 segment merge 所需空间。
为什么不不断增加分片?
更多分片可以把工作分散到多个节点,但每个分片都增加管理成本,搜索也可能扇出到更多位置。较大的分片减少这类开销,但恢复或迁移可能更慢。副本增加冗余,也增加存储和写入工作;副本不是备份。
也要测试故障场景
同时测量读写峰值,然后测试失去一个节点。其余节点需要足够的磁盘、内存和处理能力,以在目标时间内恢复。对于持续增长的时序数据,rollover 在满足选定条件时创建新索引,有助于限制索引大小。这些决策适用于用户自行管理分片设置的部署。
.
