• ELK学习笔记之elasticsearch中 refresh 和flush区别


    0x00 概述

    elasticsearch中有两个比较重要的操作:refresh 和 flush,两个操作都涉及到数据操作和磁盘性能。

    0x01 refresh操作

    当我们向ES发送请求的时候,我们发现es貌似可以在我们发请求的同时进行搜索。而这个实时建索引并可以被搜索的过程实际上是一次es 索引提交(commit)的过程,如果这个提交的过程直接将数据写入磁盘(fsync)必然会影响性能,所以es中设计了一种机制,即:先将index-buffer中文档(document)解析完成的segment写到filesystem cache之中,这样避免了比较损耗性能io操作,又可以使document可以被搜索。以上从index-buffer中取数据到filesystem cache中的过程叫做refresh。
     
    # refresh操作可以通过API设置:
    POST /index/_settings
    {“refresh_interval”: “10s”}
    
    # 当我们进行大规模的创建索引操作的时候,最好将将refresh关闭。
    POST /index/_settings
    {“refresh_interval”: “-1″}
     
    es默认的refresh间隔时间是1s,这也是为什么ES可以进行近乎实时的搜索。
     

    0x02 flush操作与translog

    我们可能已经意识到如果数据在filesystem cache之中是很有可能在意外的故障中丢失。这个时候就需要一种机制,可以将对es的操作记录下来,来确保当出现故障的时候,保留在filesystem的数据不会丢失,并在重启的时候可以从这个记录中将数据恢复过来。elasticsearch提供了translog来记录这些操作。
    当向elasticsearch发送创建document索引请求的时候,document数据会先进入到index buffer之后,与此同时会将操作记录在translog之中,当发生refresh时(数据从index buffer中进入filesystem cache的过程)translog中的操作记录并不会被清除,而是当数据从filesystem cache中被写入磁盘之后才会将translog中清空。而从filesystem cache写入磁盘的过程就是flush。可能有点晕,我画了一个图帮大家理解这个过程:

    总结一下translog的功能:

    1.保证在filesystem cache中的数据不会因为elasticsearch重启或是发生意外故障的时候丢失。
    2.当系统重启时会从translog中恢复之前记录的操作。
    3.当对elasticsearch进行CRUD操作的时候,会先到translog之中进行查找,因为tranlog之中保存的是最新的数据。
    4.translog的清除时间时进行flush操作之后(将数据从filesystem cache刷入disk之中)。
     

    再总结一下flush操作的时间点:

    1.es的各个shard会每个30分钟进行一次flush操作。
    2.当translog的数据达到某个上限的时候会进行一次flush操作。
     

    有关于translog和flush的一些配置项:

    index.translog.flush_threshold_ops:当发生多少次操作时进行一次flush。默认是 unlimited。
    index.translog.flush_threshold_size:当translog的大小达到此值时会进行一次flush操作。默认是512mb。
    index.translog.flush_threshold_period:在指定的时间间隔内如果没有进行flush操作,会进行一次强制flush操作。默认是30m。
    index.translog.interval:多少时间间隔内会检查一次translog,来进行一次flush操作。es会随机的在这个值到这个值的2倍大小之间进行一次操作,默认是5s。
     
  • 相关阅读:
    计算机操作系统实验之_进程观测_实验报告
    KVO(NSKeyValueObserving 键 值编码)与KVC(NSKeyValueCoding 键值观察机制)详解
    用arrayWithObject:初始化,参数为空数组NSArray时出现的异常
    用QtCreator实现可扩展对话框实验
    xcode4 设置调试错误信息小结
    从“Qt信号槽机制”到”iOS(MVC)中的Target——Action机制”
    Qt源码分析之信号和槽机制
    objectivec 学习之NSMutableDictionary介绍
    iOS面试题汇总 (1)
    报告论文:关于一个小型学生信息管理系统研究
  • 原文地址:https://www.cnblogs.com/JetpropelledSnake/p/14069628.html
Copyright © 2020-2023  润新知