SQL老司机，在SQL中计算 array & map & json数据-阿里云开发者社区

SQL老司机，在SQL中计算 array & map & json数据

2018-06-19 10245

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

本文涉及的产品

对象存储 OSS，20GB 3个月

对象存储 OSS，内容安全 1000次 1年

文件存储 NAS，50GB 3个月

简介： 场景通常，我们处理数据，一列数据类型要么是字符串，要么是数字，这些都是primitive类型的数据。在某些比较复杂的业务场景下，我们会在一列中使用复杂的格式，例如数组array, 对象(map)，json等格式来表示复杂的数据，例如： __source__: 11.

场景

通常，我们处理数据，一列数据类型要么是字符串，要么是数字，这些都是primitive类型的数据。在某些比较复杂的业务场景下，我们会在一列中使用复杂的格式，例如数组array, 对象(map)，json等格式来表示复杂的数据，例如：

__source__:  11.164.232.105
__tag__:__hostname__:  vm-req-170103232316569850-tianchi111932.tc
__topic__:  TestTopic_4
array_column:  [1,2,3]
double_column:  1.23
map_column:  {"a":1,"b":2}
text_column:  商品
        
          
        
        
        
          
          AI 代码解读

array_column 是数组类型。假如，我们希望统计array_column中所有数值的汇总值，那么我们得遍历每一行的数组中的每一个元素。

unnest语法

unnest( array) as table_alias(column_name)
表示把array类型展开成多行，行的名称为column_name。

unnest(map) as table(key_name, value_name)

表示把map类型展开成多行，key的名称为key_name, value的名称为value_name

        
          
        
        
        
          
          AI 代码解读

注意，由于unnest接收的是array或者map类型的数据，如果用户的输入是个字符串类型，那么要先转化成json类型，然后再转化成array类型或map类型，转化的方式是cast(json_parse(array_column) as array(bigint))

遍历数组每一个元素

使用SQL把array展开成多行：

* | select  array_column, a   from log, unnest( cast( json_parse(array_column)   as array(bigint) ) ) as  t(a)
        
          
        
        
        
          
          AI 代码解读

上述SQL把数组展开成多行数字，unnest( cast( json_parse(array_column) as array(bigint) ) ) as t(a)，unnest语法把数组展开，以t来命名新生成的表，使用a来引用展开后的列。结果如下图：

统计数组中的每个元素的和

* | select   sum(a)    from log, unnest( cast( json_parse(array_column)   as array(bigint) ) ) as  t(a)
        
          
        
        
        
          
          AI 代码解读

按照数组中的每个元素进行group by计算

* | select   a, count(1)    from log, unnest( cast( json_parse(array_column)   as array(bigint) ) ) as  t(a)     group by a
        
          
        
        
        
          
          AI 代码解读

遍历Map

遍历Map中的元素

* | select  map_column , a,b    from log, unnest( cast( json_parse(map_column)   as map(varchar, bigint) ) ) as  t(a,b)
        
          
        
        
        
          
          AI 代码解读

按照Map的key进行group by 统计

* | select   key,  sum(value)    from log, unnest( cast( json_parse(map_column)   as map(varchar, bigint) ) ) as  t(key,value)    GROUP  BY  key
        
          
        
        
        
          
          AI 代码解读

格式化显示histogram,numeric_histogram的结果

1.histogram

histogram函数类似于count group by 语法。语法参考文档。

通常我们看到histogram的结果如下：

* | select histogram(method)
        
          
        
        
        
          
          AI 代码解读

是一串json，无法配置视图展示，我们可以用unnest语法，把json展开成多行配置视图，例如:

* | select  key , value  from( select histogram(method) as his from log) , unnest(his ) as t(key,value)
        
          
        
        
        
          
          AI 代码解读

接下来，可以配置可视化视图：

2. numeric_histogram

numeric_histogram语法是为了把数值列分配到多个桶中去，相当于对数值列进行group by，具体语法参考文档

* | select numeric_histogram(10,Latency)
        
          
        
        
        
          
          AI 代码解读

numeric_histogram的输出如下：

为了格式化展示该结果，我们这样写SQL:

* |  select key,value from(select numeric_histogram(10,Latency) as his from log) , unnest(his) as t(key,value)
        
          
        
        
        
          
          AI 代码解读

结果如下：

同时配置柱状图的形式展示：

SQL老司机，在SQL中计算 array & map & json数据

场景

unnest语法

遍历数组每一个元素

遍历Map

格式化显示histogram,numeric_histogram的结果

1.histogram

2. numeric_histogram

云存储

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

SQL老司机，在SQL中计算 array & map & json数据

场景

unnest语法

遍历数组每一个元素

遍历Map

格式化显示histogram,numeric_histogram的结果

1.histogram

2. numeric_histogram

云存储

热门文章

最新文章

相关课程

相关电子书

相关实验场景