PostgreSQL中的partition-wise aggregation

partition-wise aggregation允许对每个分区分别执行的分区表进行分组或聚合。如果GROUP BY子句不包括分区键，则只能在每个分区的基础上执行部分聚合，并且必须稍后执行最终处理。由于partitionwise分组或聚合可能在计划期间占用大量CPU时间和内存，因此默认设置为关闭。

通过变量enable_partitionwise_aggregate控制是否启用该特性。

创建一个分区表，用于测试：

create table pagg_t (a int, b int, c text, d int) partition by list(c);

create table pagg_t_p1 partition of pagg_t for values in ('000', '001', '002', '003');

create table pagg_t_p2 partition of pagg_t for values in ('004', '005', '006', '007');

create table pagg_t_p3 partition of pagg_t for values in ('008', '009', '010', '011');

insert into pagg_t select i % 20, i % 30, to_char(i % 12, 'fm0000'), i % 30 from generate_series(0, 2999) i;

analyze pagg_t;

postgres=# show enable_partitionwise_aggregate;

 off

postgres=# explain (costs off) select c, sum(a), avg(b), count(*), min(a), max(b) from pagg_t group by c having avg(d) < 15 order by 1, 2, 3;

 Sort

   Sort Key: pagg_t_p1.c, (sum(pagg_t_p1.a)), (avg(pagg_t_p1.b))

   ->  HashAggregate

         Group Key: pagg_t_p1.c

         Filter: (avg(pagg_t_p1.d) < '15'::numeric)

         ->  Append

               ->  Seq Scan on pagg_t_p1

               ->  Seq Scan on pagg_t_p2

               ->  Seq Scan on pagg_t_p3

postgres=#

默认情况下，需要先分别扫描表的所有分区，将分区结果整合在一起（Append），然后执行哈希聚合（HashAggregate），最后进行排序（Sort）。

启用智能分区聚合功能，查看相同的聚合操作：

postgres=# set enable_partitionwise_aggregate=on;

SET

postgres=# show enable_partitionwise_aggregate;

 on

postgres=# explain (costs off) select c, sum(a), avg(b), count(*), min(a), max(b) from pagg_t group by c having avg(d) < 15 order by 1, 2, 3;

 Sort

   Sort Key: pagg_t_p1.c, (sum(pagg_t_p1.a)), (avg(pagg_t_p1.b))

   ->  Append

         ->  HashAggregate

               Group Key: pagg_t_p1.c

               Filter: (avg(pagg_t_p1.d) < '15'::numeric)

               ->  Seq Scan on pagg_t_p1

         ->  HashAggregate

               Group Key: pagg_t_p2.c

               Filter: (avg(pagg_t_p2.d) < '15'::numeric)

               ->  Seq Scan on pagg_t_p2

         ->  HashAggregate

               Group Key: pagg_t_p3.c

               Filter: (avg(pagg_t_p3.d) < '15'::numeric)

               ->  Seq Scan on pagg_t_p3

postgres=#

可以看到，启用该功能之后，先针对表中的所有分区执行哈希聚合（HashAggregate），然后将结果整合在一起（Append），最后进行排序（Sort）。其中，分区级别的聚合可以并行执行，性能会更好。

如果GROUP BY子句中没有包含分区字段，只会基于分区执行部分聚合操作，然后再对结果进行一次最终的聚合。

以下查询使用字段 a 进行分组聚合：

postgres=# explain (costs off) select a, sum(b), avg(b), count(*), min(a), max(b) from pagg_t group by a having avg(d) < 15 order by 1, 2, 3;

 Sort

   Sort Key: pagg_t_p1.a, (sum(pagg_t_p1.b)), (avg(pagg_t_p1.b))

   ->  Finalize HashAggregate

         Group Key: pagg_t_p1.a

         Filter: (avg(pagg_t_p1.d) < '15'::numeric)

         ->  Append

               ->  Partial HashAggregate

                     Group Key: pagg_t_p1.a

                     ->  Seq Scan on pagg_t_p1

               ->  Partial HashAggregate

                     Group Key: pagg_t_p2.a

                     ->  Seq Scan on pagg_t_p2

               ->  Partial HashAggregate

                     Group Key: pagg_t_p3.a

                     ->  Seq Scan on pagg_t_p3

postgres=#

由于字段 a 不是分区键，所以先执行分区级别的部分哈希聚合（Partial HashAggregate），聚合的结果中可能存在相同的分组（不同分区中的字段 a 存在相同的值），需要执行最终的哈希聚合（Finalize HashAggregate）操作。

PostgreSQL中的partition-wise aggregation的更多相关文章

PostgreSQL中的partition-wise join
与基于继承的分区(inheritance-based partitioning)不同,PostgreSQL 10中引入的声明式分区对数据如何划分没有任何影响.PostgreSQL 11的查询优化器正准 ...
PostgreSQL中RECURSIVE递归查询使用总结
RECURSIVE 前言 CTE or WITH 在WITH中使用数据修改语句 WITH使用注意事项 RECURSIVE 递归查询的过程拆解下执行的过程 1.执行非递归部分 2.执行递归部分,如果是 ...
通过arcgis在PostgreSQL中创建企业级地理数据库
部署环境: Win7 64位旗舰版软件版本: PostgreSQL-9.1.3-2-windows-x64 Postgis-pg91x64-setup-2.0.6-1 Arcgis 10.1 SP1 ...
PostgreSQL 中日期类型转换与变量使用及相关问题
PostgreSQL中日期类型与字符串类型的转换方法示例如下: postgres=# select current_date; date ------------ 2015-08-31 (1 row ...
PostgreSQL 中定义自己需要的数据类型
PostgreSQL解决某系数据库中的tinyint数据类型问题,创建自己需要的数据类型如下: CREATE DOMAIN tinyint AS smallint CONSTRAINT tinyint ...
在PostgreSQL中使用oracle_fdw访问Oracle
本文讲述如何在PostgreSQL中使用oracle_fdw访问Oracle上的数据. 1. 安装oracle_fdw 可以参照:oracle_fdw in github 编译安装oracle_fdw ...
[原创]PostgreSQL中十进制、二进制、十六进制之间的相互转换
在PostgreSQL中,二进制.十进制.十六进制之间的转换是非常方便的,如下: 十进制转十六进制和二进制 mydb=# SELECT to_hex(10); to_hex -------- a (1 ...
用python随机生成数据，再插入到postgresql中
用python随机生成学生姓名,三科成绩和班级数据,再插入到postgresql中. 模块用psycopg2 random import random import psycopg2 fname=[' ...
PostgreSQL 中如何实现group_concat
之前在MySQL中使用group_concat,觉得超级好用. 今天在PostgreSQL需要用到这样的场景,就去学习了一下. 在PostgreSQL中提供了arr_agg的函数来实现聚合,不过返回的 ...
Postgresql中临时表（temporary table）的特性和用法
熟悉Oracle的人,相比对临时表(temporary table)并不陌生,很多场景对解决问题起到不错的作用,开源库Postgresql中,也有临时表的概念,虽然和Oracle中临时表名字相同,使用 ...

随机推荐

ffmpeg 把视频转换为图片
ffmpeg -i "Tail of Hope.mp4" -r 1 -q:v 2 -f image2 pic-%03d.jpeg
Docke 镜像加速
一.国内获取Docker镜像时,访问 https://hub.docker.com/速度缓慢,只有几十K左右,这种情况可以使用国内的一些docker镜像,国内有些企业做了镜像拷贝工作,这样,我们就可以 ...
Linux命令——basename、dirname
简介这2个命令多用于shell脚本用法 basename filename_will_full_path dirname filename_will_full_path 对于但后缀的情况,base ...
Mac电脑永久路由的添加方法是是什么？ Mac校园网连接教程
学校校园网面向全校师生开放,无奈Windows用户基数大,学校只为Windows平台制作了内网连接工具,Mac平台资源较少,本人查阅相关资料后,总结整理出以下步骤,方便本校学生连接校园网. 有永久路由 ...
Java数据库操作的一些注意
练习一:插入一个学生的四六级成绩: //课后练习 public class task3 { //添加一条数据 @Test public void testInsert() { int id=1; Sc ...
lock in share mode 和 select for update
lock in share mode 和 select for update 2018年07月11日 01:57:58 道不虚行只在人阅读数 146 版权声明:欢迎转载,请注明出处 https ...
git免密
免账号密码输入 git clone https://lichuanfa%40gitcloud.com.cn:lcf13870752164@git.c.citic/Citic-Data/bigdata_ ...
danci2
composite 英 ['kɒmpəzɪt] 美 [kɑm'pɑzɪt] n. 复合材料:合成物:菊科 adj. 复合的:合成的:菊科的 vt. 使合成:使混合 a composite of 网络释 ...
用Queue控制python多线程并发数量
python多线程如果不进行并发数量控制,在启动线程数量多到一定程度后,会造成线程无法启动的错误. 下面介绍用Queue控制多线程并发数量的方法(python3). # -*- coding: utf ...
使用idea 调试java -jar xxx.jar方式启动
今日思语:希望是什么?希望就是你还在挣扎中... idea是一个功能强大的java开发工具,可以很方便的帮助开发人员进行开发工作. 1.有时我们通过使用java -jar xxx.jar方式启动可执 ...

PostgreSQL中的partition-wise aggregation

PostgreSQL中的partition-wise aggregation的更多相关文章

随机推荐

热门专题