这段ES英文如何正确的理解啊?
Charele 回复了问题 • 3 人关注 • 4 个回复 • 1343 次浏览 • 2023-07-31 17:11
使用script类型的pipeline时报错
I_Like 回复了问题 • 2 人关注 • 2 个回复 • 1204 次浏览 • 2023-07-21 22:07
用极限网关实现ES容灾,简单!
yangmf2040 发表了文章 • 0 个评论 • 2912 次浏览 • 2023-07-20 10:33
身为 IT 人士,大伙身边的各种系统肯定不少吧。系统虽多,但最最最重要的那套、那几套,大伙肯定是捧在手心,关怀备至。如此重要的系统,万一发生故障了且短期无法恢复,该如何保障业务持续运行?
有过这方面思考或经验的同学,肯定脱口而出--切灾备啊。
是的,接下来我来介绍下我们的 ES 灾备方案。当然如果你有更好的,请使用各种可用的渠道联系我们。
总体设计
通过[极限网关](https://www.infinilabs.com/docs/latest/gateway/)将应用对主集群的写操作,复制到灾备集群。应用发送的读请求则直接转发到主集群,并将响应结果转发给应用。应用对网关无感知,访问方式与访问 ES 集群一样。
方案优势
- 轻量级
极限网关使用 Golang 编写,安装包很小,只有 10MB 左右,没有任何外部环境依赖,部署安装都非常简单,只需要下载对应平台的二进制可执行文件,启动网关程序的二进制程序文件执行即可。
- 跨版本支持
极限网关针对不同的 Elasticsearch 版本做了兼容和针对性处理,能够让业务代码无缝的进行适配,后端 Elasticsearch 集群版本升级能够做到无缝过渡,降低版本升级和数据迁移的复杂度。
- 高可用
极限网关内置多种高可用解决方案,前端请求入口支持基于虚拟 IP 的双机热备,后端集群支持集群拓扑的自动感知,节点上下线能自动发现,自动处理后端故障,自动进行请求的重试和迁移。
- 灵活性
主备集群都是可读可写,切换迅速,只需切换网关到另一套配置即可。回切灵活,恢复使用原配置即可。
架构图

网关程序部署
下载
根据操作系统和平台选择下面相应的[安装包](https://release.infinilabs.com/gateway/stable/):
解压到指定目录:
<br /> mkdir gateway<br /> tar -zxf xxx.gz -C gateway<br />
修改网关配置
在此[ 下载 ](https://raw.githubusercontent. ... ch.yml)网关配置,默认网关会加载配置文件 gateway.yml ,如果要指定其他配置文件使用 -config 选项指定。
网关配置文件内容较多,下面展示必要部分。
```primary
PRIMARY_ENDPOINT: http://192.168.56.3:7171
PRIMARY_USERNAME: elastic
PRIMARY_PASSWORD: password
PRIMARY_MAX_QPS_PER_NODE: 10000
PRIMARY_MAX_BYTES_PER_NODE: 104857600 #100MB/s
PRIMARY_MAX_CONNECTION_PER_NODE: 200
PRIMARY_DISCOVERY_ENABLED: false
PRIMARY_DISCOVERY_REFRESH_ENABLED: falsebackup
BACKUP_ENDPOINT: http://192.168.56.3:9200
BACKUP_USERNAME: admin
BACKUP_PASSWORD: admin
BACKUP_MAX_QPS_PER_NODE: 10000
BACKUP_MAX_BYTES_PER_NODE: 104857600 #100MB/s
BACKUP_MAX_CONNECTION_PER_NODE: 200
BACKUP_DISCOVERY_ENABLED: false
BACKUP_DISCOVERY_REFRESH_ENABLED: false
```
PRIMARY_ENDPOINT:配置主集群地址和端口
PRIMARY_USERNAME、PRIMARY_PASSWORD: 访问主集群的用户信息
BACKUP_ENDPOINT:配置备集群地址和端口
BACKUP_USERNAME、BACKUP_PASSWORD: 访问备集群的用户信息
运行网关
前台运行
直接运行网关程序即可启动极限网关了,如下:
<br /> ./gateway-linux-amd64<br />
后台运行
<br /> ./gateway-linux-amd64 -service install<br /> Success<br /> ./gateway-linux-amd64 -service start<br /> Success<br />
卸载服务
<br /> ./gateway-linux-amd64 -service stop<br /> Success<br /> ./gateway-linux-amd64 -service uninstall<br /> Success<br />
灾备功能测试
在灾备场景下,为保证数据一致性,对集群的访问操作都通过网关进行。注意只有 bulk API 的操作才会被复制到备集群。
在此次测试中,网关灾备配置功能为:
- 主备集群正常时
读写请求正常执行;
写请求被记录到队列,备集群实时消费队列数据。
- 当主集群故障时
写入请求报错,主备集群都不写入数据;
查询请求转到备集群执行,并返回结果给客户端。
- 当备集群故障时
读写请求都正常执行;
写操作记录到磁盘队列,待备集群恢复后,自动消费队列数据直到两个集群一致。
主备集群正常时写入、查询测试
写入数据
```通过网关写入数据
curl -X POST "localhost:18000/_bulk?pretty" -H 'Content-Type: application/json' -uelastic:password -d'
{ "index" : { "_index" : "test", "_id" : "1" } }
{ "field1" : "value1" }
{ "create" : { "_index" : "test", "_id" : "2" } }
{ "field2" : "value2" }
'
```

查询数据
```查询主集群
curl 192.168.56.3:7171/test/_search?pretty -uelastic:password
<br /> <br /> <br /> <br />
查询备集群
curl 192.168.56.3:9200/test/_search?pretty -uadmin:admin
<br /> <br /> <br /> <br />
查询网关,网关转发给主集群执行
curl 192.168.56.3:18000/test/_search?pretty -uelastic:password
```

主备集群都已写入数据,且数据一致。通过网关查询,也正常返回。
删除和更新文档
```通过网关删除和更新文档
curl -X POST "192.168.56.3:18000/_bulk?pretty" -H 'Content-Type: application/json' -uelastic:password -d'
{ "delete" : { "_index" : "test", "_id" : "1" } }
{ "update" : {"_id" : "2", "_index" : "test"} }
{ "doc" : {"field2" : "value2-updated"} }
'
```

查询数据
```查询主集群
curl 192.168.56.3:7171/test/_search?pretty -uelastic:password
<br /> <br /> <br /> <br />
查询备集群
curl 192.168.56.3:9200/test/_search?pretty -uadmin:admin
```

两个集群都已执行删除和更新操作,数据一致。
主集群故障时写入、查询测试
为模拟主集群故障,直接关闭主集群。
写入数据
```通过网关写入数据
curl -X POST "192.168.56.3:18000/_bulk?pretty" -H 'Content-Type: application/json' -uelastic:password -d'
{ "index" : { "_index" : "test", "_id" : "3" } }
{ "field3" : "value3" }
{ "create" : { "_index" : "test", "_id" : "4" } }
{ "field4" : "value4" }
'
```
写入数据报错

查询数据
```通过网关查询,因为主集群不可用,网关将查询转发到备集群执行
curl 192.168.56.3:18000/test/_search?pretty -uelastic:password
```

正常查询到数据,说明请求被转发到了备集群执行。
备集群故障时写入、查询测试
为模拟备集群故障,直接关闭备集群。
写入数据
```通过网关写入数据
curl -X POST "192.168.56.3:18000/_bulk?pretty" -H 'Content-Type: application/json' -uelastic:password -d'
{ "index" : { "_index" : "test", "_id" : "5" } }
{ "field5" : "value5" }
{ "create" : { "_index" : "test", "_id" : "6" } }
{ "field6" : "value6" }
'
```

数据正常写入。
查询数据
```通过网关查询
curl 192.168.56.3:18000/test/_search?pretty -uelastic:password
```

查询成功返回。主集群成功写入了两条新数据。同时此数据会被记录到备集群的队列中,待备集群恢复后,会消费此队列追数据。
恢复备集群
启动备集群。
查询数据
等待片刻或通过 [INFINI Console](https://www.infinilabs.com/docs/latest/console/) 确定网关队列消费完毕后,查询备集群的数据。
(生产和消费 offset 相同,说明消费完毕。)

```查询备集群的数据
curl 192.168.56.3:9200/test/_search?pretty -uadmin:admin
```

备集群启动后自动消费队列数据,消费完后备集群数据达到与主集群数据一致。
灾备切换
测试了这么多,终于到切换的时刻了。切换前我们判断下主系统是否短期无法修复。

如果我们判断主用系统无法短时间恢复,要执行切换。非常简单,我们直接将配置文件中定义的主备集群互换,然后重启网关程序就行了。但我们推荐在相同主机上另部署一套网关程序--网关B,先前那套用网关A指代。网关B中的配置文件把原备集群定义为主集群,原主集群定义为备集群。若要执行切换,我们先停止网关A,然后启动网关B,此时应用连接到网关(端口不变),就把原备系统当作主系统使用,把原主系统当作备系统,也就完成了主备系统的切换。
灾备回切
当原主集群修复后,正常启动,就会从消费队列追写修复期间产生数据直到主备数据一致,同样我们可通过 INFINI Console 查看消费的进度。如果大家还是担心数据的一致性,INFINI Console 还能帮大家做[校验数据]()任务,做到数据完全一致后(文档数量及文档内容一致),才进行回切。

回切也非常简单,停止网关B,启动网关A即可。
网关高可用
网关自带浮动 IP 模块,可进行双机热备。客户端通过 VIP 连接网关,网关出现故障时,VIP 漂移到备网关。
视频教程戳[这里](https://www.bilibili.com/video ... f57628)。

这样的优点是简单,不足是只有一个网关在线提供服务。如果想多个网关在线提供服务,则需搭配分布式消息系统一起工作,架构如下。

前端通过负载均衡将流量分散到多个在线网关,网关将消息存入分布式消息系统。此时,网关可看作无状态应用,可根据需要扩缩规模。
以上就是我介绍的ES灾备方案,是不是相当灵活了。有问题还是那句话 Call me 。
关于极限网关
INFINI Gateway 是一个面向搜索场景的高性能数据网关,所有请求都经过网关处理后再转发到后端的搜索业务集群。基于 INFINI Gateway,可以实现索引级别的限速限流、常见查询的缓存加速、查询请求的审计、查询结果的动态修改等等。
官网文档:<https://www.infinilabs.com/docs/latest/gateway>
postFilter跟聚合的作用关系
Ombres 回复了问题 • 2 人关注 • 2 个回复 • 1284 次浏览 • 2023-07-24 08:47
有关于ES里头terms聚合的问题
Charele 回复了问题 • 2 人关注 • 4 个回复 • 1356 次浏览 • 2023-07-20 14:03
给 ES 插上向量检索的翅膀 | DataFunSummit 2023 峰会演讲内容速达
liaosy 发表了文章 • 0 个评论 • 2117 次浏览 • 2023-07-12 18:37
近日,由 DataFun 主办的 DataFunSummit 2023 数据基础架构峰会 圆满落下帷幕,本次峰会邀请了腾讯、百度、字节、极限科技、Zilliz 等众多企业技术专家为大家带来分布式存储以及向量数据库的架构原理、性能优化与实践解析分享。

在 向量数据库架构与实践论坛 中,极限科技搜索引擎研发工程师张磊受邀出席做了《给 ES 插上向量检索的翅膀》的主题演讲。据介绍,本次演讲主要介绍了 Elasticsearch(ES)与向量技术的融合,展示其在不同行业中的应用场景和优势,同时也对 ES 与向量的技术细节进行详细讨论,并通过具体案例演示如何利用向量提升搜索能力。
讲师介绍
张磊,极限科技 Easysearch 引擎研发工程师,2013 年开始接触 Elasticsearch,10 余年搜索相关经验,之前主要做一些围绕 Elasticsearch 在日志检索和公安大数据相关业务的开发,对 Elasticsearch 和 Lucene 源码比较熟悉,目前专注于公司内部搜索产品的开发。
《给 ES 插上向量检索的翅膀》PPT 内容








更多 PPT 内容参见 <https://elasticsearch.cn/slides/322>
关于 Easysearch

INFINI Easysearch 是一个分布式的近实时搜索与分析引擎,核心引擎基于开源的 Apache Lucene。Easysearch 衍生自基于开源协议 Apache 2.0 的 Elasticsearch 7.10 版本。Easysearch 的目标是提供一个轻量级的 Elasticsearch 可替代版本,并继续完善和支持更多的企业级功能。与 Elasticsearch 相比,Easysearch 更关注在搜索业务场景的优化和继续保持其产品的简洁与易用性。
官网文档:<https://www.infinilabs.com/doc ... gt%3B
下载地址:<https://www.infinilabs.com/download>
为什么ES集群节点重启后,恢复速度很慢?
xiaohei 回复了问题 • 3 人关注 • 2 个回复 • 1441 次浏览 • 2023-07-13 17:41
关于get和count操作
Charele 回复了问题 • 2 人关注 • 3 个回复 • 1318 次浏览 • 2023-07-14 09:55
ES分片分配中的疑问
emmning 回复了问题 • 2 人关注 • 1 个回复 • 1643 次浏览 • 2023-07-11 10:55
有关副分片的恢复问题
Charele 回复了问题 • 2 人关注 • 3 个回复 • 2056 次浏览 • 2023-07-11 13:26
关于ES快照的一个问题
kin122 回复了问题 • 2 人关注 • 1 个回复 • 2139 次浏览 • 2023-07-05 17:13
routing值会存吗?
charlesfang 回复了问题 • 2 人关注 • 1 个回复 • 2085 次浏览 • 2023-07-05 15:48
通过ssh连接远程es
God_lockin 回复了问题 • 2 人关注 • 1 个回复 • 2753 次浏览 • 2023-07-03 10:41