在ES批量插入数据超时时自动重试

本文转载自查看原文 2020-01-16 22:36 3142 elasticsearch

当我们使用ES批量插入数据的时候，一般会这样写代码：

from elasticsearch import Elasticsearch,helpers


es =Elasticsearch(hosts=[{'host':'localhost','port':9200}])

def gendata():
    mywords =['foo','bar','baz']
    
    for word in mywords:
        yield {"_index":"mywords","_type":"document","_type":"document","doc":{"word": word}}

helpersbulk(es,gendata())

但当ES的负荷过大时，这种写法可能会抛出连接超时的异常。

为了解决这个问题，在初始化ES连接对象时，可以设置一个更大的超时时间：

　　es = Elasticsearch(hosts=[{'host': 'localhost', 'port': 9200}], timeout=60)

但有时候，即时设置为60秒还是有可能遇到超时异常，但这个超时时间并非越大越好，所以最好能够让ES在遇到超时的情况下自动重试。

在创建ES连接对象时，还可以再加两个参数，实现超时自动重试3次：

es = Elasticsearch(hosts=[{'host': 'localhost', 'port': 9200}], timeout=60, max_retries=3, retry_on_timeout=True)

通过添加 max_retries和 retry_on_timeout两个参数，就能实现超时自动重试了。

如果你直接看ES的文档，你可能会找不到这两个参数，如下图所示。

这并非是ES的文档有问题，而是因为这两个参数隐藏在 **kwargs里面，如下图所示。

点进 Transport就可以看到这两个参数：

转自：https://mp.weixin.qq.com/s?src=11&timestamp=1579108394&ver=2098&signature=ZXtHL4GJONIJr9lN3KD*vHKfeujxkmmrWRnFl3Pfyu14Qc4lDyAdHN*UtHf6en*KeUFy7edlKqVVw5uxvGXpiaFdGNSX0LUYkAox81WQzZdgs7jLFcHd1-nfsgI3jPIq&new=1

免责声明！

本站转载的文章为个人学习借鉴使用，本站对版权不负任何法律责任。如果侵犯了您的隐私权益，请联系本站邮箱yoyou2525@163.com删除。

猜您在找 ElastaticSearch -- es批量插入数据使用 Python 批量将数据插入到 ES中 python批量插入数据到es和读取es数据 Feign自定义重试策略及超时时间 Promise实现超时自动重试（n次） MYSQL的数据连接超时时间设置 MYSQL的数据连接超时时间设置 es之java插入优化（批量插入） springcloud之Feign、ribbon设置超时时间和重试机制的总结 OKHttp请求超时无效问题记录（自动重试）