@Elasticsearch之深度应用及原理剖析--并发冲突处理机制

左岸anoi 2023-05-18 原文

title: ElasticSearch之深度应用及原理剖析
author: Xoni
tags:

搜索引擎
Elasticsearch
categories:
搜索引擎
Elasticsearch
abbrlink: 5a1f6e0b

第3节并发冲突处理机制剖析

3.1 详解并发冲突

在电商场景下，工作流程为：

读取商品信息，包括库存数量
用户下单购买
更新商品信息，将库存数减一
如果是多线程操作，就可能有多个线程并发的去执行上述的3步骤流程，假如此时有两个人都来读取商品数据，两个线程并发的服务于两个人，同时在进行商品库存数据的修改。假设库存为100件正确的情况：线程A将库存-1，设置为99件，线程B接着读取99件，再-1，变为98件。如果A,B线程都读取的为100件，A处理完之后修改为99件，B处理完之后再次修改为99件，此时结果就出错了。

3.2 解决方案

3.2.1 悲观锁

顾名思义，就是很悲观，每次去拿数据的时候都认为被人会修改，所以每次拿数据的时候都会加锁，以防别人修改，直到操作完成后，才会被别人执行。常见的关系型数据库，就用到了很多这样的机制，如行锁，表锁，写锁，都是在操作之前加锁。
悲观锁的优点：方便，直接加锁，对外透明，不需要额外的操作。
悲观锁的缺点：并发能力低，同一时间只能有一个操作。

3.2.2 乐观锁

乐观锁不加锁，每个线程都可以任意操作。比如每条文档中有一个version字段，新建文档后为1，修改一次累加，线程A,B同时读取到数据，version=1，A处理完之后库存为99，在写入es的时候会跟es中的版本号比较，都是1，则写入成功，version=2，B处理完之后也为99，存入es时与es中的数据的版本号。与version=2相比，明显不同，此时不会用99去更新，而是重新读取最新的数据，再减一，变为98，执行上述操作写入。

3.2.3 Elasticsearch的乐观锁

Elasticsearch的后台都是多线程异步的，多个请求之间是乱序的，可能后修改的先到，先修改的后到。
Elasticsearch的多线程异步并发修改是基于自己的**_version版本号**进行乐观锁并发控制的。
在后修改的先到时，比较版本号,版本号相同修改可以成功，而当先修改的后到时，也会比较一下_version版本号，如果不相等就再次读取新的数据修改。这样结果会就会保存为一个正确状态。
删除操作也会对这条数据的版本号加1。
在删除一个document之后，可以从一个侧面证明，它不是立即物理删除掉的，因为它的一些版本号等信息还是保留着的。先删除一条document，再重新创建这条document，其实会在delete version基础之上，再把version号加1。

3.2.4 es的乐观锁并发控制示例

先新建一条数据

PUT /test_index/_doc/4 
{ 
  "test_field": "test" 
}

模拟两个客户端，都获取到了同一条数据

GET /test_index/_doc/4 
返回
{
  "_index" : "test_index",
  "_type" : "_doc",
  "_id" : "4", 
  "_version" : 1,
  "_seq_no" : 0,
  "_primary_term" : 1, 
  "found" : true, 
  "_source" : {
    "test_field" : "test" 
  }
}

其中一个客户端，先更新了一下这个数据，同时带上数据的版本号，确保说，es中的数据的版本号，跟客户端中的数据的版本号(_seq_no)是相同的，才能修改

PUT /test_index/_doc/4 
{ 
  "test_field": "client1 changed"
}

返回结果 
{ 
  "_index" : "test_index",
  "_type" : "_doc", 
  "_id" : "4", 
  "_version" : 2, 
  "result" :"updated",
  "_shards" : { 
    "total" : 2, 
    "successful" : 2,
    "failed" : 0 
  },
  "_seq_no" : 1,
  "_primary_term" : 1
}

另外一个客户端，尝试基于version=1的数据去进行修改，同样带上(if_seq_no和if_primary_term)version版本号，进行乐观锁的并发控制

PUT /test_index/_doc/4?if_seq_no=0&if_primary_term=1 
{ 
  "test_field": "client2 changed" 
}

会出错，返回 
{ 
  "error": {
    "root_cause": [ 
      { 
        "type": "version_conflict_engine_exception",
        "reason": "[4]: version conflict, required seqNo [0], primary term [1]. current document has seqNo [1] and primary term [1]",
        "index_uuid": "RLebBAGvR9iWdUoi3t5bXw",
        "shard": "0",
        "index": "test_index"
      }
    ],
    "type": "version_conflict_engine_exception",
    "reason": "[4]: version conflict, required seqNo [0], primary term [1]. current document has seqNo [1] and primary term [1]",
    "index_uuid": "RLebBAGvR9iWdUoi3t5bXw", 
    "shard": "0", 
    "index": "test_index" 
  },
  "status": 409
}

乐观锁就成功阻止并发问题
在乐观锁成功阻止并发问题之后，尝试正确的完成更新重新进行GET请求，得到 version

GET /test_index/_doc/4
结果
{ 
  "_index" : "test_index",
  "_type" : "_doc", 
  "_id" : "4", 
  "_version" : 2,
  "_seq_no" : 1, 
  "_primary_term" : 1, 
  "found" : true,
  "_source" : {
    "test_field" : "client1 changed" 
  }
}

基于最新的数据和版本号(以前是version 现在是if_seq_no和if_primary_term )，去进行修改，修改后，带上最新的版本号，可能这个步骤会需要反复执行好几次，才能成功，特别是在多线程并发更新同一条数据很频繁的情况下

PUT /test_index/_doc/4?if_seq_no=1&if_primary_term=1 
{ 
"test_field": "client2 changed" 
}

返回
{ 
  "_index" : "test_index",
  "_type" : "_doc",
  "_id" : "4", 
  "_version" : 3, 
  "result" : "updated", 
  "_shards" : { 
    "total" : 2,
    "successful" : 2,
    "failed" : 0 
  },
  "_seq_no" : 2,
  "_primary_term" : 1
}

3.2.5 基于external version进行乐观锁并发控制

es提供了一个feature，就是说，你可以不用它提供的内部_version版本号来进行并发控制，可以基于你自己维护的一个版本号来进行并发控制。

?version=1&version_type=external

区别在于，_version_方式，只有当你提供的_version_与_es_中的version一模一样的时候，才可以进行修改，只要不一样，就报错；当version_type=external的时候，只有当你提供的version比es中的``_version大的时候，才能完成修改。es，if_seq_no=0&if_primary_term=1和文档中的值相等才能更新成功。es，_version=1，?version>1&version_type=external，才能成功，比如说?version=2&version_type=external`。

代码示例：
先创建一条数据

PUT /test_index/_doc/5 
{ 
  "test_field": "external test"
}

返回
{ 
  "_index" : "test_index", 
  "_type" : "_doc",
  "_id" : "5",
  "_version" : 1,
  "result" : "created",
  "_shards" : {
    "total" : 2, 
    "successful" : 2,
    "failed" : 0 
  },
  "_seq_no" : 3,
  "_primary_term" : 1
}

模拟两个客户端同时查询到这条数据

GET /test_index/_doc/5 
返回
{ 
  "_index" : "test_index", 
  "_type" : "_doc",
  "_id" : "5", 
  "_version" : 1,
  "_seq_no" : 3,
  "_primary_term" : 1, 
  "found" : true, 
  "_source" : { 
    "test_field" : "external test"
  } 
}

第一个客户端先进行修改，此时客户端程序是在自己的数据库中获取到了这条数据的最新版本号，比如说是2

PUT /test_index/_doc/5?version=2&version_type=external 
{ 
"test_field": "external client1 changed" 
}

返回
{
  "_index" : "test_index",
  "_type" : "_doc", 
  "_id" : "5",
  "_version" : 2, 
  "result" : "updated",
  "_shards" : {
    "total" : 2, 
    "successful" : 2,
    "failed" : 0 
  },
  "_seq_no" : 4,
  "_primary_term" : 1 
}

模拟第二个客户端，同时拿到了自己数据库中维护的那个版本号，也是2，同时基于version=2发起了修改

PUT /test_index/_doc/5?version=2&version_type=external

{
  "test_field": "external client2 changed" 
}

会出错，返回 
{ 
  "error": { 
    "root_cause": [ 
      { 
        "type": "version_conflict_engine_exception",
        "reason": "[5]: version conflict, current version [2] is higher or equal to the one provided [2]", 
        "index_uuid": "RLebBAGvR9iWdUoi3t5bXw", 
        "shard": "0",
        "index": "test_index"
      }
    ],
    "type": "version_conflict_engine_exception", 
    "reason": "[5]: version conflict, current version [2] is higher or equal to the one provided [2]",
    "index_uuid": "RLebBAGvR9iWdUoi3t5bXw",
    "shard": "0", 
    "index": "test_index" 
  },
  "status": 409 
}

在并发控制成功后，重新基于最新的版本号发起更新

GET /test_index/_doc/5

返回
{
  "_index" : "test_index", 
  "_type" : "_doc", 
  "_id" : "5", 
  "_version" : 2,
  "_seq_no" : 4, 
  "_primary_term" : 1,
  "found" : true, 
  "_source" : {
    "test_field" : "external client1 changed" 
  } 
}

PUT /test_index/_doc/5?version=3&version_type=external 
{ 
"test_field": "external client2 changed" 
}

返回
{
  "_index" : "test_index", 
  "_type" : "_doc", 
  "_id" : "5", 
  "_version" : 3,
  "result" : "updated",
  "_shards" : { 
    "total" : 2,
    "successful" : 2,
    "failed" : 0
  },
  "_seq_no" : 5,
  "_primary_term" : 1 
}

Elasticsearch 剖析 span class token 搜索引擎面试 java 全文检索

有关@Elasticsearch之深度应用及原理剖析--并发冲突处理机制的更多相关文章

ruby - 将差异补丁应用于字符串/文件 - 2
对于具有离线功能的智能手机应用程序，我正在为Xml文件创建单向文本同步。我希望我的服务器将增量/差异(例如GNU差异补丁)发送到目标设备。这是计划:Time=0Server:hasversion_1ofXmlfile(~800kiB)Client:hasversion_1ofXmlfile(~800kiB)Time=1Server:hasversion_1andversion_2ofXmlfile(each~800kiB)computesdeltaoftheseversions(=patch)(~10kiB)sendspatchtoClient(~10kiBtransferred)Cl
ruby - 如何指定 Rack 处理程序 - 2
Rackup通过Rack的默认处理程序成功运行任何Rack应用程序。例如:classRackAppdefcall(environment)['200',{'Content-Type'=>'text/html'},["Helloworld"]]endendrunRackApp.new但是当最后一行更改为使用Rack的内置CGI处理程序时，rackup给出“NoMethodErrorat/undefinedmethod`call'fornil:NilClass”:Rack::Handler::CGI.runRackApp.newRack的其他内置处理程序也提出了同样的反对意见。例如Rack
ruby-on-rails - Rails 应用程序之间的通信 - 2
我构建了两个需要相互通信和发送文件的Rails应用程序。例如，一个Rails应用程序会发送请求以查看其他应用程序数据库中的表。然后另一个应用程序将呈现该表的json并将其发回。我还希望一个应用程序将存储在其公共(public)目录中的文本文件发送到另一个应用程序的公共(public)目录。我从来没有做过这样的事情，所以我什至不知道从哪里开始。任何帮助，将不胜感激。谢谢! 最佳答案无论Rails是什么，几乎所有Web应用程序都有您的要求，大多数现代Web应用程序都需要相互通信。但是有一个小小的理解需要你坚持下去，网站不应直接访问彼此
ruby - 无法运行 Rails 2.x 应用程序 - 2
我尝试运行2.x应用程序。我使用rvm并为此应用程序设置其他版本的ruby:$rvmuseree-1.8.7-head我尝试运行服务器，然后出现很多错误:$script/serverNOTE:Gem.source_indexisdeprecated,useSpecification.Itwillberemovedonorafter2011-11-01.Gem.source_indexcalledfrom/Users/serg/rails_projects_terminal/work_proj/spohelp/config/../vendor/rails/railties/lib/r
ruby-on-rails - Rails 应用程序中的 Rails : How are you using application_controller. rb 是新手吗？ - 2
刚入门rails，开始慢慢理解。有人可以解释或给我一些关于在application_controller中编码的好处或时间和原因的想法吗？有哪些用例。您如何为Rails应用程序使用应用程序Controller？我不想在那里放太多代码，因为据我了解，每个请求都会调用此Controller。这是真的？最佳答案 ApplicationController实际上是您应用程序中的每个其他Controller都将从中继承的类(尽管这不是强制性的)。我同意不要用太多代码弄乱它并保持干净整洁的态度，尽管在某些情况下ApplicationContr
ruby-on-rails - 如何在我的 Rails 应用程序 View 中打印 ruby 变量的内容？ - 2
我是一个Rails初学者，但我想从我的RailsView(html.haml文件)中查看Ruby变量的内容。我试图在ruby中打印出变量(认为它会在终端中出现)，但没有得到任何结果。有什么建议吗？我知道Rails调试器，但更喜欢使用inspect来打印我的变量。最佳答案您可以在View中使用puts方法将信息输出到服务器控制台。您应该能够在View中的任何位置使用Haml执行以下操作:-puts@my_variable.inspect 关于ruby-on-rails-如何在我的R
ruby-on-rails - 如何在 Gem 中获取 Rails 应用程序的根目录 - 2
是否可以在应用程序中包含的gem代码中知道应用程序的Rails文件系统根目录？这是gem来源的示例:moduleMyGemdefself.included(base)putsRails.root#returnnilendendActionController::Base.send:include,MyGem谢谢，抱歉我的英语不好最佳答案我发现解决类似问题的解决方案是使用railtie初始化程序包含我的模块。所以，在你的/lib/mygem/railtie.rbmoduleMyGemclassRailtie使用此代码，您的模块将在
世界前沿3D开发引擎HOOPS全面讲解——集3D数据读取、3D图形渲染、3D数据发布于一体的全新3D应用开发工具 - 2
无论您是想搭建桌面端、WEB端或者移动端APP应用，HOOPSPlatform组件都可以为您提供弹性的3D集成架构，同时，由工业领域3D技术专家组成的HOOPS技术团队也能为您提供技术支持服务。如果您的客户期望有一种在多个平台（桌面/WEB/APP，而且某些客户端是“瘦”客户端）快速、方便地将数据接入到3D应用系统的解决方案，并且当访问数据时，在各个平台上的性能和用户体验保持一致，HOOPSPlatform将帮助您完成。利用HOOPSPlatform，您可以开发在任何环境下的3D基础应用架构。HOOPSPlatform可以帮您打造3D创新型产品，HOOPSSDK包含的技术有：快速且准确的CAD
叮咚买菜基于 Apache Doris 统一 OLAP 引擎的应用实践 - 2
导读：随着叮咚买菜业务的发展，不同的业务场景对数据分析提出了不同的需求，他们希望引入一款实时OLAP数据库，构建一个灵活的多维实时查询和分析的平台，统一数据的接入和查询方案，解决各业务线对数据高效实时查询和精细化运营的需求。经过调研选型，最终引入ApacheDoris作为最终的OLAP分析引擎，Doris作为核心的OLAP引擎支持复杂地分析操作、提供多维的数据视图，在叮咚买菜数十个业务场景中广泛应用。作者｜叮咚买菜资深数据工程师韩青叮咚买菜创立于2017年5月，是一家专注美好食物的创业公司。叮咚买菜专注吃的事业，为满足更多人“想吃什么”而努力，通过美好食材的供应、美好滋味的开发以及美食品牌的孵
【鸿蒙应用开发系列】- 获取系统设备信息以及版本API兼容调用方式 - 2
在应用开发中，有时候我们需要获取系统的设备信息，用于数据上报和行为分析。那在鸿蒙系统中，我们应该怎么去获取设备的系统信息呢，比如说获取手机的系统版本号、手机的制造商、手机型号等数据。1、获取方式这里分为两种情况，一种是设备信息的获取，一种是系统信息的获取。1.1、获取设备信息获取设备信息，鸿蒙的SDK包为我们提供了DeviceInfo类，通过该类的一些静态方法，可以获取设备信息，DeviceInfo类的包路径为：ohos.system.DeviceInfo.具体的方法如下：ModifierandTypeMethodDescriptionstatic StringgetAbiList()Obt