1.COALESCE( value1,value2,... )
  
  The COALESCE function returns the fist not NULL value from the list of values. If all the values in the list are NULL, then it returns NULL.
  
  Example: COALESCE(NULL,NULL,5,NULL,4) returns 5;
  
  coalesce()函数,在处理空值时,'' 和NULL是不一样的,函数认为NULL是空值,但'' 不是空值,
  
  故coalesce('','test')会返回'',而不是test;而coalesce(NULL,'test')回返回test;
  
  2.NTILE,ROW_NUMBER,RANK,DENSE_RANK;
  
  ①NTILE:用户将分组数据按照顺序切分成N片,返回当前切片值。
  
  NTILE(n),用于将分组数据按照顺序切分成n片,返回当前切片值
  
  NTILE不支持ROWS BETWEEN,比如 NTILE(2) OVER(PARTITION BY cookieid ORDER BY createtime ROWS BETWEEN 3 PRECEDING AND CURRENT ROW)
  
  如果切片不均匀,默认增加第一个切片的分布
  
  SELECT
  
  cookieid,
  
  createtime,
  
  pv,
  
  NTILE(2) OVER(PARTITION BY cookieid ORDER BY createtime) AS rn1, --分组内将数据分成2片
  
  NTILE(3) OVER(PARTITION BY cookieid ORDER BY createtime) AS rn2, --分组内将数据分成3片
  
  NTILE(4) OVER(ORDER BY createtime) AS rn3 --将所有数据分成4片
  
  FROM lxw1234
  
  ORDER BY cookieid,createtime;
  
  cookieid day pv rn1 rn2 rn3
  
  -------------------------------------------------
  
  cookie1 2015-04-10 1 1 1 1
  
  cookie1 2015-04-11 5 1 1 1
  
  cookie1 2015-04-12 7 1 1 2
  
  cookie1 2015-04-13 3 1 2 2
  
  cookie1 2015-04-14 2 2 2 3
  
  cookie1 2015-04-15 4 2 3 3
  
  cookie1 2015-04-16 4 2 3 4
  
  cookie2 2015-04-10 2 1 1 1
  
  cookie2 2015-04-11 3 1 1 1
  
  cookie2 2015-04-12 5 1 1 2
  
  cookie2 2015-04-13 6 1 2 2
  
  cookie2 2015-04-14 3 2 2 3
  
  cookie2 2015-04-15 9 2 3 4
  
  cookie2 2015-04-16 7 2 3 4
  
  比如,统计一个cookie,pv数最多的前1/3的天
  
  SELECT
  
  cookieid,
  
  createtime,
  
  pv,
  
  NTILE(3) OVER(PARTITION BY cookieid ORDER BY pv DESC) AS rn
  
  FROM lxw1234;
  
  --rn = 1 的记录,就是我们想要的结果
  
  cookieid day pv rn
  
  ----------------------------------
  
  cookie1 2015-04-12 7 1
  
  cookie1 2015-04-11 5 1
  
  cookie1 2015-04-15 4 1
  
  cookie1 2015-04-16 4 2
  
  cookie1 2015-04-13 3 2
  
  cookie1 2015-04-14 2 3
  
  cookie1 2015-04-10 1 3
  
  cookie2 2015-04-15 9 1
  
  cookie2 2015-04-16 7 1
  
  cookie2 2015-04-13 6 1
  
  cookie2 2015-04-12 5 2
  
  cookie2 2015-04-14 3 2
  
  cookie2 2015-04-11 3 3
  
  cookie2 2015-04-10 2 3
  
  ②ROW_NUMBER:Row_number函数返回一个唯一的值,当碰到相同数据时,排名按照记录集中记录的顺序依次递增。
  
  ROW_NUMBER() –从1开始,按照顺序,生成分组内记录的序列
  
  –比如,按照pv降序排列,生成分组内每天的pv名次
  
  ROW_NUMBER() 的应用场景非常多,再比如,获取分组内排序第一的记录;获取一个session中的第一条refer等。
  
  SELECT
  
  cookieid,
  
  createtime,
  
  pv,
  
  ROW_NUMBER() OVER(PARTITION BY cookieid ORDER BY pv desc) AS rn
  
  FROM lxw1234;
  
  cookieid day pv rn
  
  -------------------------------------------
  
  cookie1 2015-04-12 7 1
  
  cookie1 2015-04-11 5 2
  
  cookie1 2015-04-15 4 3
  
  cookie1 2015-04-16 4 4
  
  cookie1 2015-04-13 3 5
  
  cookie1 2015-04-14 2 6
  
  cookie1 2015-04-10 1 7
  
  cookie2 2015-04-15 9 1
  
  cookie2 2015-04-16 7 2
  
  cookie2 2015-04-13 6 3
  
  cookie2 2015-04-12 5 4
  
  cookie2 2015-04-14 3 5
  
  cookie2 2015-04-11 3 6
  
  cookie2 2015-04-10 2 7
  
  ③RANK 和 DENSE_RANK:
  
  RANK:Rank函数返回一个唯一的值,除非遇到相同的数据时,此时所有相同数据的排名是一样的,同时会在最后一条相同记录和下一条不同记录的排名之间空出排名。
  
  DENSE_RANK:Dense_rank函数返回一个唯一的值,除非当碰到相同数据时,此时所有相同数据的排名都是一样的。
  
  —RANK() 生成数据项在分组中的排名,排名相等会在名次中留下空位
  
  —DENSE_RANK() 生成数据项在分组中的排名,排名相等会在名次中不会留下空位
  
  SELECT
  
  cookieid,
  
  createtime,
  
  pv,
  
  RANK() OVER(PARTITION BY cookieid ORDER BY pv desc) AS rn1,
  
  DENSE_RANK() OVER(PARTITION BY cookieid ORDER BY pv desc) AS rn2,
  
  ROW_NUMBER() OVER(PARTITION BY cookieid ORDER BY pv DESC) AS rn3
  
  FROM lxw1234
  
  WHERE cookieid = 'cookie1';
  
  cookieid day pv rn1 rn2 rn3

Slf4j public class TestThreadlocal {
private static ThreadLocal<String> local = ThreadLocal.withInitial(() -> "init");

public static void main(String[] args) throws InterruptedException {
Runnable r = new TT();
new Thread(r, "thread1").start();
Thread.sleep(2000);
new Thread(r, www.michenggw.com"thread2"www.baishenyvip.com).start();
log.info("exit"www.bsylept.com);
private static class TT implements Runnable {
@Override
public void run(www.jiahuayulpt.com ) {
log.info(local.get(www.yongshi123.cn));
local.set(Thread.currentThread().getName(www.dfgjpt.com));
log.info("set local name and get: {}", local.get());
  
  --------------------------------------------------
  
  cookie1 2015-04-12 7 1 1 1
  
  cookie1 2015-04-11 5 2 2 2
  
  cookie1 2015-04-15 4 3 3 3
  
  cookie1 2015-04-16 4 3 3 4
  
  cookie1 2015-04-13 3 5 4 5
  
  cookie1 2015-04-14 2 6 5 6
  
  cookie1 2015-04-10 1 7 6 7
  
  rn1: 15号和16号并列第3, 13号排第5
  
  rn2: 15号和16号并列第3, 13号排第4
  
  rn3: 如果相等,则按记录值排序,生成唯一的次序,如果所有记录值都相等,或许会随机排吧。

关于Hive中常用函数需要注意的点小合集的更多相关文章

  1. LoadRunner中常用函数参考手册

    基础篇1:LoadRunner中常用函数参考手册 常用函数列表 web_url web_submmit_form VS web_submmit_data VS web_custom_request w ...

  2. Hive中日期函数总结

    --Hive中日期函数总结: --1.时间戳函数 --日期转时间戳:从1970-01-01 00:00:00 UTC到指定时间的秒数 select unix_timestamp(); --获得当前时区 ...

  3. hive中标准偏差函数stddev()详细讲解

    1.标准偏差概念 标准偏差(Std Dev,Standard Deviation) -统计学名词.一种度量数据分布的分散程度之标准,用以衡量数据值偏离算术平均值的程度.标准偏差越小,这些值偏离平均值就 ...

  4. PHP 常用函数库和一些实用小技巧

    PHP 常用函数库和一些实用小技巧 作者: 字体:[增加 减小] 类型:转载   包括文件读取函式,文件写入函式,静态页面生成函式,目录删除函式等   文件读取函式 //文件读取函式 function ...

  5. OpenCV图像处理中常用函数汇总(1)

    //俗话说:好记性不如烂笔头 //用到opencv 中的函数时往往会一时记不起这个函数的具体参数怎么设置,故在此将常用函数做一汇总: Mat srcImage = imread("C:/Us ...

  6. JavaScript中常用函数(入门级)(持续更新)

    本文中枫竹梦介绍一些JavaScript中入门级的常用函数,对于已经过了入门的童鞋可选择略过,都是一些非常实用的函数.如果发现什么问题,欢迎讨论. 问题列表 Q1: 设计一个函数repeatIt(st ...

  7. Hive中自定义函数

    Hive的自定义的函数的步骤: 1°.自定义UDF extends org.apache.hadoop.hive.ql.exec.UDF 2°.需要实现evaluate函数,evaluate函数支持重 ...

  8. 5. openCV中常用函数学习

    一.前言 经过两个星期的努力,一边学习,一边写代码,初步完成了毕业论文系统的界面和一些基本功能,主要包括:1 数据的读写和显示,及相关的基本操作(放大.缩小和移动):2 样本数据的选择:3 数据归一化 ...

  9. javascript中常用函数汇总

    js中函数很多,在实际项目开发中,函数的应用可以很大程度上简化我们的代码,所以在此记下开发中js中常用的函数,增强记忆. 1.isNaN(X):函数用于检查其参数是否是非数字值. 如果 x 是特殊的非 ...

随机推荐

  1. Luogu4921/4931 情侣?给我烧了! 组合、递推

    4921 4931 第一眼看着就像容斥,但是容斥不怎么好做-- 第二眼想到错排,结果错排公式糊上去错了-- 不难考虑到可以先选\(K\)对情侣坐在一起,剩下\(N-K\)对错排 选\(K\)对情侣坐在 ...

  2. 解决PowerDesigner 16 Generate Datebase For Sql2005/2008 对象名sysproperties无效的问题

    在PowerDesigner 16 中生成的sql语句,在执行的时候报错:对象名sysproperties 无效的错误;造成此问题的原因是由于Sql 2005.2008 删除了系统表 sysprope ...

  3. [转]zookeeper集群 initLimit和syncLimit

    initLimit和syncLimit是针对集群的参数 1.tickTime:CS通信心跳数 Zookeeper 服务器之间或客户端与服务器之间维持心跳的时间间隔,也就是每个 tickTime 时间就 ...

  4. Scala学习(五)练习

    Scala中的类&练习 1. 改进Counter类,让它不要在Int.MaxValue时变成负数 程序代码: class Counter { private var value=100 def ...

  5. [JSOI2016]病毒感染[dp]

    题意 有 \(n​\) 个村庄按标号排列,每个村庄有一个死亡速度 \(a_i​\) 表示每天死 \(a_i​\) 人(除非你治好这个村庄). 你从 1 号村庄出发,每天可以选择向相邻的村庄进发或者治愈 ...

  6. Ext JS 4 的类系统

    前言 我们知道,JavaScript中没有真正的类,它是一种面向原型的语言 .这种语言一个强大的特性就是灵活,实现一个功能可以有很多不同的方式,用不同的编码风格和技巧.但随之也带来了代码的不可预测和难 ...

  7. element-ui + vue + node.js 与 服务器 Python 应用的跨域问题

    跨越问题解决的两种办法: 1. 在 config => index.js 中配置 proxyTable 代理: proxyTable: { '/charts': { target: 'http: ...

  8. springcloud 笔记

    官方教程 http://projects.spring.io/spring-cloud/ guide https://github.com/spring-guides 伪官方教程 https://sp ...

  9. Gitlab备份和恢复操作记录

    前面已经介绍了Gitlab环境部署记录,这里简单说下Gitlab的备份和恢复操作记录: 1)Gitlab的备份目录路径设置 [root@code-server ~]# vim /etc/gitlab/ ...

  10. kvm虚拟化关闭虚拟网卡virbr0的方法

    我们知道:kvm虚拟化环境安装好后,ifconfig会发现多了一个虚拟网卡virbr0这是由于安装和启用了libvirt服务后生成的,libvirt在服务器(host)上生成一个 virtual ne ...