oracle或mysql获取分组后每组的前三条数据

2023-12-04 00:40

本文主要是介绍oracle或mysql获取分组后每组的前三条数据,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

文章目录

  • 1 分组排序查询
    • 1.1 引言
    • 1.2 子查询
      • 1.2.1 方法一
        • 1.2.1.1 方法分析
      • 1.2.2 方法二
      • 1.2.3 方法三
    • 1.3 自定义变量
      • 1.3.1 SQL分析
    • 1.4 窗口函数
      • 1.4.1 mysql
      • 1.4.2 oracle

1 分组排序查询

1.1 引言

排名是数据库中的一个经典题目,实际上又根据排名的具体细节可分为3种场景:

  • 连续排名:例如薪水3000、2000、2000、1000排名结果为1-2-3-4,体现同薪不同名,排名类似于编号
  • 同薪同名但总排名不连续:例如同样的薪水分布,排名结果为1-2-2-4
  • 同薪同名且总排名连续,同样的薪水排名结果为1-2-2-3

值得一提的是:在Oracle等数据库中有窗口函数,可非常容易实现这些需求,而MySQL直到8.0版本也引入相关函数

1.2 子查询

1.2.1 方法一

排名第N的记录 意味着该表中存在N-1个比其更高的记录
注意这里的N-1个更高的薪水是指去重后的N-1个,实际对应人数可能不止N-1个
最后返回的记录也应该去重,因为可能不止一个记录排名第N
由于对于每个记录的where条件都要执行一遍子查询,注定其效率低下

select a.* 
from
(
select t1.*,(select count(*)+1 fromwhere 分组字段=t1.分组字段 and 排序字段<t1.排序字段) as group_id
from 表 t1
) a
where a.group_id<=3
1.2.1.1 方法分析

在查询列中使用嵌套子查询,在嵌套子查询中用要分组的字段作为关联字段,采用内关联,分组字段不是唯一的,查出就会翻倍,再用排序字段错位比较大小,就可以得出条数。但是 把条数查询不是放在列中而是放在where后就只会有一个条数,而不会每行都有条数,如下:(假定只查询部门编号是20)

把求行数子查询放在where后面
select * from employee e1 ,employee e2 where e1.deptno=e2.deptno and e1.sal<e2.sal and e1.deptno = '20'

在这里插入图片描述
再对其求行数处理:(假定只查询部门编号是20)

把求行数子查询放在where后面
select count(*) from employee e1 ,employee e2 where e1.deptno=e2.deptno and e1.sal<e2.sal and e1.deptno = '20'

在这里插入图片描述
要想能查出前三行,并且每行都显示行数,就必须这样处理:(假定只查询部门编号是20)

select t1.*,(select count(*)+1 from employee where deptno=t1.deptno and sal<t1.sal) as group_id
from employee t1 where t1.deptno = '20'

缺点:如果一个部门下存在同样的工资金额,那么就会有两个一样的行号了

1.2.2 方法二

和方法一差不多,但是没有把排序的行放在记录中

SELECT*
FROMemployee tpn
WHERE(SELECTCOUNT(*)FROMemployee tWHEREtpn.deptno = t.deptno AND tpn.sal <= t.sal) < 3

1.2.3 方法三

此处的建表语句是模拟按照每位学生分组后,成绩排名前三的要去

CREATE TABLE `score` (`id` int NOT NULL AUTO_INCREMENT,`stu_id` varchar(255) COLLATE utf8mb4_general_ci DEFAULT NULL,`subject_name` varchar(255) CHARACTER SET utf8mb4 COLLATE utf8mb4_general_ci DEFAULT NULL,`score` int DEFAULT NULL,PRIMARY KEY (`id`)
) ENGINE=InnoDB AUTO_INCREMENT=13 DEFAULT CHARSET=utf8mb4 COLLATE=utf8mb4_general_ci;

插入语句

INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (1, '1', '语文', 86);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (2, '1', '英语', 88);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (3, '1', '数学', 93);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (4, '1', '体育', 80);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (5, '2', '语文', 83);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (6, '2', '数学', 87);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (7, '2', '英语', 79);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (8, '2', '体育', 90);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (9, '3', '语文', 86);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (10, '3', '数学', 83);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (11, '3', '英语', 81);
INSERT INTO `score`(`id`, `stu_id`, `subject_name`, `score`) VALUES (12, '3', '体育', 86);

此处是SQL还是用了子查询语句的分数来进行排序,同时要注意在子查询语句中使用limit语法的话,需要在嵌套一层,不然会提示语法错误

select * from 
score a
where score in (select score from ( select score from score s where s.stu_id = a.stu_id order by  score desc limit 3) a 
)

1.3 自定义变量

自定义变量可以解决同部门下相同工资却有同样排序编号问题

SET @rank:=0;
SELECT * FROM 
(SELECT a.*,IF(@tmp=deptno,@rank:=@rank + 1,@rank:=1) AS group_id,@tmp:=deptno AS tmpFROM employee a  ORDER BY deptno,sal DESC) b
WHERE b.group_id<=5

如图:
在这里插入图片描述

1.3.1 SQL分析

采用了局部变量方法,mysql变量详情理解:https://jingzh.blog.csdn.net/article/details/96328410
倘若只有一条信息,可能会让临时变量一直增加所以先这样设置SET @rank:=0;
核心语句:
IF(@tmp=deptno,@rank:=@rank + 1,@rank:=1)则利用中间变量@tmp存储上一条记录的deptno,并和当前的对比,如若相同,则序号@rank增加1,否则初始化@rank为1
@tmp:=deptno AS tmp则用于将当前的province_name值记录下来,供下一条记录使用

1.4 窗口函数

1.4.1 mysql

mysql8.0中有相关的内置函数,而且考虑了各种排名问题:

  • row_number(): 同记录不同名,相当于行号,例如3000、2000、2000、1000排名后为1、2、3、4
  • rank(): 同记录同名,有跳级,例如3000、2000、2000、1000排名后为1、2、2、4
  • dense_rank(): 同薪同名,无跳级,例如3000、2000、2000、1000排名后为1、2、2、3
  • ntile(): 分桶排名,即首先按桶的个数分出第一二三桶,然后各桶内从1排名,实际不是很常用

另外这三个函数必须要要与其搭档over()配套使用,over()中的参数常见的有两个,分别是

  • partition by,按某字段切分
  • order by,与常规order by用法一致,也区分ASC(默认)和DESC,因为排名总得有个依据
SELECT t.*         FROM (SELECT ROW_NUMBER() OVER(PARTITION BY 分组字段 ORDER BY 排序字段 DESC) rn,         b.*         FROM 表 b) t         WHERE t.rn <= 3  ;

1.4.2 oracle

oracle中是使用over函数

SELECT t.*         FROM (SELECT ROW_NUMBER() OVER(PARTITION BY 分组字段 ORDER BY 排序字段 DESC) rn,         b.*         FROM 表 b) t         WHERE t.rn <= 3  ;

此处使用了析构函数
Oracle中的分析函数over()的详细解析
两种写法都是获取分组中的伪列序号为目的

这篇关于oracle或mysql获取分组后每组的前三条数据的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/451472

相关文章

SQL Server修改数据库名及物理数据文件名操作步骤

《SQLServer修改数据库名及物理数据文件名操作步骤》在SQLServer中重命名数据库是一个常见的操作,但需要确保用户具有足够的权限来执行此操作,:本文主要介绍SQLServer修改数据... 目录一、背景介绍二、操作步骤2.1 设置为单用户模式(断开连接)2.2 修改数据库名称2.3 查找逻辑文件名

C++中RAII资源获取即初始化

《C++中RAII资源获取即初始化》RAII通过构造/析构自动管理资源生命周期,确保安全释放,本文就来介绍一下C++中的RAII技术及其应用,具有一定的参考价值,感兴趣的可以了解一下... 目录一、核心原理与机制二、标准库中的RAII实现三、自定义RAII类设计原则四、常见应用场景1. 内存管理2. 文件操

SQL Server数据库死锁处理超详细攻略

《SQLServer数据库死锁处理超详细攻略》SQLServer作为主流数据库管理系统,在高并发场景下可能面临死锁问题,影响系统性能和稳定性,这篇文章主要给大家介绍了关于SQLServer数据库死... 目录一、引言二、查询 Sqlserver 中造成死锁的 SPID三、用内置函数查询执行信息1. sp_w

canal实现mysql数据同步的详细过程

《canal实现mysql数据同步的详细过程》:本文主要介绍canal实现mysql数据同步的详细过程,本文通过实例图文相结合给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的... 目录1、canal下载2、mysql同步用户创建和授权3、canal admin安装和启动4、canal

SQL中JOIN操作的条件使用总结与实践

《SQL中JOIN操作的条件使用总结与实践》在SQL查询中,JOIN操作是多表关联的核心工具,本文将从原理,场景和最佳实践三个方面总结JOIN条件的使用规则,希望可以帮助开发者精准控制查询逻辑... 目录一、ON与WHERE的本质区别二、场景化条件使用规则三、最佳实践建议1.优先使用ON条件2.WHERE用

MySQL存储过程之循环遍历查询的结果集详解

《MySQL存储过程之循环遍历查询的结果集详解》:本文主要介绍MySQL存储过程之循环遍历查询的结果集,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录前言1. 表结构2. 存储过程3. 关于存储过程的SQL补充总结前言近来碰到这样一个问题:在生产上导入的数据发现

SpringBoot服务获取Pod当前IP的两种方案

《SpringBoot服务获取Pod当前IP的两种方案》在Kubernetes集群中,SpringBoot服务获取Pod当前IP的方案主要有两种,通过环境变量注入或通过Java代码动态获取网络接口IP... 目录方案一:通过 Kubernetes Downward API 注入环境变量原理步骤方案二:通过

MySQL 衍生表(Derived Tables)的使用

《MySQL衍生表(DerivedTables)的使用》本文主要介绍了MySQL衍生表(DerivedTables)的使用,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学... 目录一、衍生表简介1.1 衍生表基本用法1.2 自定义列名1.3 衍生表的局限在SQL的查询语句select

MySQL 横向衍生表(Lateral Derived Tables)的实现

《MySQL横向衍生表(LateralDerivedTables)的实现》横向衍生表适用于在需要通过子查询获取中间结果集的场景,相对于普通衍生表,横向衍生表可以引用在其之前出现过的表名,本文就来... 目录一、横向衍生表用法示例1.1 用法示例1.2 使用建议前面我们介绍过mysql中的衍生表(From子句

六个案例搞懂mysql间隙锁

《六个案例搞懂mysql间隙锁》MySQL中的间隙是指索引中两个索引键之间的空间,间隙锁用于防止范围查询期间的幻读,本文主要介绍了六个案例搞懂mysql间隙锁,具有一定的参考价值,感兴趣的可以了解一下... 目录概念解释间隙锁详解间隙锁触发条件间隙锁加锁规则案例演示案例一:唯一索引等值锁定存在的数据案例二: