IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 大数据 -> 佛系更hive sql实务遇到的问题 -> 正文阅读

[大数据]佛系更hive sql实务遇到的问题

基础

in操作符

允许我们在where 语句中规定多个值,例如我想要知道张三李四王五的成绩

select score,name from student_score_sheet 
where name in ('张三','李四','王五'); 

原表
在这里插入图片描述
运行后
在这里插入图片描述

join 的条件写on 1 = 1代表代表什么

答案是:毫无卵用。
第一个表2行,第二个表3行。on 1=1 得到6行
实例如下

表a:
在这里插入图片描述

表b
在这里插入图片描述

select * from a join b on 1 = 1 

结果如下
在这里插入图片描述

常见错误

where 条件写在group by 后面【应该写在前面】

distinct 和 group by 一起使用

例如

select distinct day,count(phone_number),province 
from a
group by day,province

这么写不行

select day,province,count(phone_number) from (
select distinct day,province,phone_number from a )tmp1
group by day,province;

join后面语句的误用

join后面要跟括号或直接的表名,不能跟select

select a.phone_number,a.province from a
join select b.phone_number,b.name from b on a.phone_number = b.phone_number

要写括号!!!

select a.phone_number,a.province from a
join ( select b.phone_number,b.name from b ) b on a.phone_number = b.phone_number

提升技巧

计算占比

over() 函数

原表

在这里插入图片描述
诉求:计算这几个人的拥有的书籍的数量占比

又臭又长的代码:

select book_num/total_book_num as ratio,name from student_book_sheet a
join (select sum(book_num ) as total_book_num from student_book_sheet ) b on 1=1;

利用over()快速计算

select book_num/sum(book_num) over( ) as ratio,name from student_book_sheet;

在这里插入图片描述

over()分组跟group by 分组的区别

原表
在这里插入图片描述

感觉over()用来算占比比较合适,group by 用来算汇总
例如:

select sum(book_num),name,class from student_book_sheet2 group by name,class;

这么写相当于没有汇总
在这里插入图片描述

select sum(book_num),class from student_book_sheet2 group by class;

在这里插入图片描述

over()的效果 就相当于在每一个人那里,显示了他所在的班级的书籍总量,你看第一条张三的200,是高三一班的所有人的所有书籍的总和。
在这里插入图片描述

  大数据 最新文章
实现Kafka至少消费一次
亚马逊云科技:还在苦于ETL?Zero ETL的时代
初探MapReduce
【SpringBoot框架篇】32.基于注解+redis实现
Elasticsearch:如何减少 Elasticsearch 集
Go redis操作
Redis面试题
专题五 Redis高并发场景
基于GBase8s和Calcite的多数据源查询
Redis——底层数据结构原理
上一篇文章      下一篇文章      查看所有文章
加:2022-07-04 22:59:49  更:2022-07-04 23:00:22 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年5日历 -2024/5/19 18:34:58-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码