详解GaussDB(DWS)的query_band负载识别与应用

华为云开发者社区 2023-05-14 原文

摘要：query_band是一个会话级别（session）的GUC参数，本身是字符串类型，支持任意形式字符组合。

本文分享自华为云社区《GaussDB(DWS)的query_band负载识别与应用》，作者：门前一棵葡萄树。

query_band概述

GaussDB(DWS)实现了基于query_band的负载识别和优先级调度，一方面提供了更为灵活的负载识别手段，不再局限于依据“用户-资源池”的映射关系将作业路由至对应资源池，提供了“键值对-资源池”的路由方式；另一方面实现了作业优先级调度，出现排队时按照优先级调度作业。

管理员用户可根据业务场景及作业类别配置query_band关联的资源池和优先级等实现更为灵活的负载管理。如果业务未配置query_band或用户未将query_band关联行为时，作业会默认使用用户关联的资源池和默认优先级(Medium)。

query_band是什么？

query_band是一个会话级别（session）的GUC参数，本身是字符串类型，支持任意形式字符组合。query_band用于负载识别时，为了便于区分、解决无意义字符串难以理解的问题，仅支持识别键值对形式的字符串。query_band键值对有以下限制：

仅支持识别键值对形式的字符串，即：“key=value”；
有效字符：数字0~9、大写字母A~Z、小写字母a~z以及部分符号（‘.’、‘-’、‘_’ 以及‘#’）；
单个键值对最大长度1024；
支持多个键值对组合，键值对之间使用分号分隔；
示例：SET query_band = ‘JobName=abc;AppName=test;ApplicationName=jdbc’。

query_band负载识别

GaussDB(DWS)提供的资源管理功能，从资源池维度实现了资源隔离管控和查询调度，借此实现了不同业务间的资源隔离。资源池作为资源管控和查询调度的基本单位，查询运行前需要确定使用哪个资源池，在查询调度和查询运行过程中使用该资源池资源（计算资源/并发等）。

查询是由用户发起运行的，而且一般情况下用户都是按业务划分的，因此理所当然地就想到将用户和资源池关联起来，以此实现用户的查询在对应资源池运行的效果。GaussDB(DWS)提供了用户-资源池关联的能力，默认情况下用户关联默认资源池，可根据业务需求创建自定义资源，并将用户关联至自定义资源池，用户查询依据“用户-资源池”的关联关系将查询路由至对应资源池执行，以此实现对查询并发、内存及CPU资源的管控。从而实现对不同业务之间的资源限制和隔离，满足数据库混合负载需求，保证查询执行时资源调度的有序可控。

“用户-资源池”提供的用户和资源池的关联关系，对于用户和业务混合交叉（多个用户均对应多个业务）的场景就不适用了。此外一个资源池内不同用户的作业可能有不同优先级，此时就需要给不同用户或业务配置不同优先级，实现优先级调度。因此就需要提供一种能力，一方面不再局限于“用户-资源池”的关联方式，一方面还可以实现资源池内的优先级调度。这种情况下，query_band负载识别应运而生。

query_band负载识别提供了两方面能力：

一方面提供了更为灵活的负载识别手段，不再局限于依据“用户-资源池”的映射关系将作业路由至对应资源池，提供了“键值对-资源池”的路由方式；
另一方面实现了优先级调度，支持为不同用户或业务设置不同的优先级，实现资源池内的优先级调度。

query_band功能实现

工作原理

query_band负载识别以键值对为单位，用户使用的键值对可能有很多，但实际上关联负载行为的键值对只有很少的一部分，为方便后续理解，这里按是否关联负载行为，将键值对分为有效键值对和无效键值对：

有效键值对：有关联负载行为；

无效键值对：未关联任何负载行为。

会话内设置的query_band可能包含多个键值对，不同场景下可能要使用不同的键值对进行负载识别，以实现负载控制（分时/分天）。当query_band内包含唯一有效键值对时，使用该键值对进行负载识别；当query_band内包含多个有效键值对时，按以下规则选择有效键值对进行负载识别：

键值对匹配顺序不同时，优先选择匹配序号最小的键值对进行负载识别；
所有键值对匹配顺序相同时，按照先后顺序选择靠前的键值对进行负载识别

示例：假设set query_band='b=1;a=3;c=1'中所有键值对匹配顺序都一样，则选择b=1进行负载识别；假设set query_band=‘b=1;a=3;c=1’ ，其中b=1顺序为-1，a=3顺序为4，c=1顺序为1，则选择c=1进行负载识别。

识别能力

管理员用户根据业务场景和负载变化，调整业务（不同业务对应不同query_band键值对）使用的资源池和调度优先级。业务运行过程中负载识别与query_band工作机制如下：

会话内设置query_band，示例：SET query_band='JobName=abc;UserName=elk'；
负载管理模块解析query_band，判断其中是否包含有效键值对；
query_band内不包含有效键值对，则使用"用户-资源池"的方式将作业路由至对应资源池运行，同时设置作业优先级为Medium；
query_band内包含有效键值对，则使用“键值对-资源池”的方式将作业路由至对应资源池运行，同时设置作业优先级为键值对关联优先级；
作业在对应资源池，按照设置的优先级进行排队，等待查询调度。

优先级调度

query_band支持高中低(High/Medium/Low)三个优先级，同时提供Rush作为特殊优先级（绿色通道），默认优先级为Medium。实践过程中，建议大部分作业使用Medium优先级，优先级较低作业使用Low优先级，特权作业使用High优先级，High作业不建议过多。Rush优先级作为特殊场景下应急使用，平时不建议使用。

调度时优先调度高优作业，高优作业全部调度完才调度低优作业，GaussDB(DWS)包含多个优先级队列。除动态负载管理场景下，CN全局并发控制队列不支持优先级调度外，以下队列均支持优先级调度（按优先级顺序调度）：

静态负载管理场景下，CN全局并发控制队列；
动态负载管理场景下，CCN全局内存管控队列；
资源池并发控制和内存管控队列。（动态静态均支持）

作业运行过程中可通过pgxc_session_wlmstat/pg_session_wlmstat视图查询作业优先级，视图中优先级显示为INT类型，数字和优先级对应关系如下：

query_band对外接口

gs_wlm_set_queryband_action

提供FUNCTION：gs_wlm_set_queryband_action(query_band cstring, action cstring, order int4)用于设置query_band负载行为，函数返回值类型为bool，表示函数调用是否成功，包含三个入参，含义如下：

query_band：query_band键值对
action：负载行为
order：匹配顺序（序号），缺省参数，默认值-1

应用示例：设置query_band键值对“UserName=elk”关联资源池p1、优先级Rush、匹配顺序为1。

SELECT * FROM gs_wlm_set_queryband_action('UserName=elk','respool=p1;priority=rush',1);

gs_wlm_set_queryband_order

提供FUNCTION：gs_wlm_set_queryband_order(query_band cstring, order int4)用于修改query_band匹配顺序，函数返回值类型为bool，表示函数调用是否成功，包含两个入参，含义如下：

query_band：query_band键值对
order：匹配顺序（序号），缺省参数，默认值-1

除-1外，不允许两个query_band键值对使用相同匹配顺序，设置query_band键值对匹配顺序时，如果存在query_band持有该匹配顺序，则其顺序自动+1，重复上述步骤直至无相同匹配顺序的query_band键值对存在。匹配顺序中-1最大，代表匹配优先级最低，最小值为0，代表匹配优先级最高。

应用示例：假设query_band键值对“UserName=elk”的匹配顺序为1，“UserName=bin”的匹配顺序为2，“UserName=yagao”的匹配顺序为3，此时设置query_band键值对“UserName=on”匹配顺序为1。

SELECT * FROM gs_wlm_set_queryband_order('UserName=on',1);

设置完成后，query_band键值对匹配顺序如下：

系统表pg_workload_action

query_band支持多种负载行为，使用系统表pg_workload_action存储不同query_band键值对对应的负载行为。为了后续扩展性（新增负载行为不需要新增字段），系统表设计采用一行对应一个负载行为的方式存储，当一个query_band键值对关联多个负载行为时，每个负载行为存储一行数据。系统表包含四个字段：

qband：键值对
class：负载行为类别
object：负载行为名称
action：关联的负载行为

query_band目前支持以下负载行为，其中query_band键值对的匹配顺序（序号）也作为一种负载行为存储在系统表中。

备注：默认值不需要存储在系统表中；资源池保存的是OID。

示例：假设已经设置query_band键值对“UserName=elk”关联资源池p1、优先级Rush、匹配顺序为1；“UserName=on”关联资源池p1、优先级Medium、匹配顺序为-1。查询pg_workload_action结果如下：

postgres=# select * from pg_workload_action order by 1,2;
 qband | classname | objname | action
--------------+-----------+----------+--------
 UserName=elk | order | respool  | 1
 UserName=elk | workload  | respool  | 16722
 UserName=elk | workload  | priority | rush
 UserName=on | workload  | respool  | 16722
(4 rows)

pg_queryband_action视图

pg_workload_action系统表用于存储query_band键值对负载行为，查询query_band行为可以直接查询该表，但是随着每一个负载行为显示一行的方式易用性较差，因此我们提供了pg_queryband_action用于查询所有query_band键值对的负载行为，每一行对应一个键值对的所有负载行为。

示例：假设已经设置query_band键值对“UserName=elk”关联资源池p1、优先级Rush、匹配顺序为1；“UserName=on”关联资源池p1、优先级Medium、匹配顺序为-1。查询pg_queryband_action结果如下：

postgres=# select * from pg_queryband_action;
 qband | respool_id | respool | priority | qborder
--------------+------------+---------+----------+---------
 UserName=on | 16722 | p1      | Medium   | -1
 UserName=elk | 16722 | p1      | rush     | 1
(2 rows)

query_band应用

基础应用

创建资源池respool_1，并创建用户user_1关联资源池respool_1、respool_2。不设置query_band负载行为场景下，使用user_1用户运行作业，此时user_1作业全部路由至respool_1运行，优先级为Medium。

设置query_band键值对"JobName=elk"的负载行为为关联资源池respool_2，优先级为Medium；设置query_band键值对"JobName=on"的负载行为为优先级High。user_1用户分别设置不同的query_band运行作业，不同作业运行方式、关联资源池及作业优先级如下表所示：

扩展应用（用户优先级调度）

创建资源池respool_1，并创建用户user_1、user_2、user_3关联资源池respool_1。不设置query_band负载行为场景下，使用user_1、user_2和user_3用户运行作业，此时user_1、user_2和user_3作业全部路由至respool_1运行，优先级均为Medium。

设置query_band键值对"UserName=elk"的优先级为High；设置query_band键值对"UserName=on"的优先级为Low。

备注：“UserName=elk”、“UserName=on”只用于用户标识，没有特殊含义，用户可按需配置。

按以下方式设置用户默认query_band：

ALTER USER user_2 SET query_band='UserName=elk';
ALTER USER user_3 SET query_band='UserName=on';

会话内不单独设置query_band，使用user_1、user_2和user_3用户运行作业，此时user_1作业优先级为Medium（默认优先级），user_2作业优先级为High（对应键值对“UserName=elk”），user_3作业优先级为Low（对应键值对“UserName=on”）。

此外，用户还可设置包含多个键值对的query_band，在不同场景下（或不同时间段），按照不同键值对进行负载识别，实现更为灵活的负载控制，这里就不再赘述了。

点击关注，第一时间了解华为云新鲜技术~

有关详解GaussDB(DWS)的query_band负载识别与应用的更多相关文章

ruby - 将差异补丁应用于字符串/文件 - 2
对于具有离线功能的智能手机应用程序，我正在为Xml文件创建单向文本同步。我希望我的服务器将增量/差异(例如GNU差异补丁)发送到目标设备。这是计划:Time=0Server:hasversion_1ofXmlfile(~800kiB)Client:hasversion_1ofXmlfile(~800kiB)Time=1Server:hasversion_1andversion_2ofXmlfile(each~800kiB)computesdeltaoftheseversions(=patch)(~10kiB)sendspatchtoClient(~10kiBtransferred)Cl
ruby-on-rails - Rails 应用程序之间的通信 - 2
我构建了两个需要相互通信和发送文件的Rails应用程序。例如，一个Rails应用程序会发送请求以查看其他应用程序数据库中的表。然后另一个应用程序将呈现该表的json并将其发回。我还希望一个应用程序将存储在其公共(public)目录中的文本文件发送到另一个应用程序的公共(public)目录。我从来没有做过这样的事情，所以我什至不知道从哪里开始。任何帮助，将不胜感激。谢谢! 最佳答案无论Rails是什么，几乎所有Web应用程序都有您的要求，大多数现代Web应用程序都需要相互通信。但是有一个小小的理解需要你坚持下去，网站不应直接访问彼此
ruby - 无法运行 Rails 2.x 应用程序 - 2
我尝试运行2.x应用程序。我使用rvm并为此应用程序设置其他版本的ruby:$rvmuseree-1.8.7-head我尝试运行服务器，然后出现很多错误:$script/serverNOTE:Gem.source_indexisdeprecated,useSpecification.Itwillberemovedonorafter2011-11-01.Gem.source_indexcalledfrom/Users/serg/rails_projects_terminal/work_proj/spohelp/config/../vendor/rails/railties/lib/r
ruby-on-rails - Rails 应用程序中的 Rails : How are you using application_controller. rb 是新手吗？ - 2
刚入门rails，开始慢慢理解。有人可以解释或给我一些关于在application_controller中编码的好处或时间和原因的想法吗？有哪些用例。您如何为Rails应用程序使用应用程序Controller？我不想在那里放太多代码，因为据我了解，每个请求都会调用此Controller。这是真的？最佳答案 ApplicationController实际上是您应用程序中的每个其他Controller都将从中继承的类(尽管这不是强制性的)。我同意不要用太多代码弄乱它并保持干净整洁的态度，尽管在某些情况下ApplicationContr
ruby-on-rails - 如何在我的 Rails 应用程序 View 中打印 ruby 变量的内容？ - 2
我是一个Rails初学者，但我想从我的RailsView(html.haml文件)中查看Ruby变量的内容。我试图在ruby中打印出变量(认为它会在终端中出现)，但没有得到任何结果。有什么建议吗？我知道Rails调试器，但更喜欢使用inspect来打印我的变量。最佳答案您可以在View中使用puts方法将信息输出到服务器控制台。您应该能够在View中的任何位置使用Haml执行以下操作:-puts@my_variable.inspect 关于ruby-on-rails-如何在我的R
ruby-on-rails - 如何在 Gem 中获取 Rails 应用程序的根目录 - 2
是否可以在应用程序中包含的gem代码中知道应用程序的Rails文件系统根目录？这是gem来源的示例:moduleMyGemdefself.included(base)putsRails.root#returnnilendendActionController::Base.send:include,MyGem谢谢，抱歉我的英语不好最佳答案我发现解决类似问题的解决方案是使用railtie初始化程序包含我的模块。所以，在你的/lib/mygem/railtie.rbmoduleMyGemclassRailtie使用此代码，您的模块将在
报告回顾丨模型进化狂飙，DetectGPT能否识别最新模型生成结果？ - 2
导读语言模型给我们的生产生活带来了极大便利，但同时不少人也利用他们从事作弊工作。如何规避这些难辨真伪的文字所产生的负面影响也成为一大难题。在3月9日智源Live第33期活动「DetectGPT：判断文本是否为机器生成的工具」中，主讲人Eric为我们讲解了DetectGPT工作背后的思路——一种基于概率曲率检测的用于检测模型生成文本的工具，它可以帮助我们更好地分辨文章的来源和可信度，对保护信息真实、防止欺诈等方面具有重要意义。本次报告主要围绕其功能，实现和效果等展开。（文末点击“阅读原文”，查看活动回放。）Ericmitchell斯坦福大学计算机系四年级博士生，由ChelseaFinn和Chri
世界前沿3D开发引擎HOOPS全面讲解——集3D数据读取、3D图形渲染、3D数据发布于一体的全新3D应用开发工具 - 2
无论您是想搭建桌面端、WEB端或者移动端APP应用，HOOPSPlatform组件都可以为您提供弹性的3D集成架构，同时，由工业领域3D技术专家组成的HOOPS技术团队也能为您提供技术支持服务。如果您的客户期望有一种在多个平台（桌面/WEB/APP，而且某些客户端是“瘦”客户端）快速、方便地将数据接入到3D应用系统的解决方案，并且当访问数据时，在各个平台上的性能和用户体验保持一致，HOOPSPlatform将帮助您完成。利用HOOPSPlatform，您可以开发在任何环境下的3D基础应用架构。HOOPSPlatform可以帮您打造3D创新型产品，HOOPSSDK包含的技术有：快速且准确的CAD
叮咚买菜基于 Apache Doris 统一 OLAP 引擎的应用实践 - 2
导读：随着叮咚买菜业务的发展，不同的业务场景对数据分析提出了不同的需求，他们希望引入一款实时OLAP数据库，构建一个灵活的多维实时查询和分析的平台，统一数据的接入和查询方案，解决各业务线对数据高效实时查询和精细化运营的需求。经过调研选型，最终引入ApacheDoris作为最终的OLAP分析引擎，Doris作为核心的OLAP引擎支持复杂地分析操作、提供多维的数据视图，在叮咚买菜数十个业务场景中广泛应用。作者｜叮咚买菜资深数据工程师韩青叮咚买菜创立于2017年5月，是一家专注美好食物的创业公司。叮咚买菜专注吃的事业，为满足更多人“想吃什么”而努力，通过美好食材的供应、美好滋味的开发以及美食品牌的孵
【鸿蒙应用开发系列】- 获取系统设备信息以及版本API兼容调用方式 - 2
在应用开发中，有时候我们需要获取系统的设备信息，用于数据上报和行为分析。那在鸿蒙系统中，我们应该怎么去获取设备的系统信息呢，比如说获取手机的系统版本号、手机的制造商、手机型号等数据。1、获取方式这里分为两种情况，一种是设备信息的获取，一种是系统信息的获取。1.1、获取设备信息获取设备信息，鸿蒙的SDK包为我们提供了DeviceInfo类，通过该类的一些静态方法，可以获取设备信息，DeviceInfo类的包路径为：ohos.system.DeviceInfo.具体的方法如下：ModifierandTypeMethodDescriptionstatic StringgetAbiList()Obt