京公网安备 11010802034615号
经营许可证编号:京B2-20210330
来源:AirPython
作者:星安果
多表查询,也称为多表连接查询;作为关系型数据库最主要的查询方式,在日常工作中被广泛使用
常见的多表查询操作包含:子查询、内连接、左外连接、右外连接、完全连接、交叉连接
本篇文章将利用一个实例逐一介绍这些操作
以 Mysql 数据库为例,创建两张数据表:
student - 学生表
record - 选课记录表
其中,学生表 id 字段对应选课记录表中的 student_id 字段
Sql 如下:
# 学生表:student
create table student
(
id int not null
primary key,
name varchar(255) null,
age int null
)
comment '学生表';
# 选课记录表:record
create table record
(
id int not null
primary key,
name varchar(255) not null,
student_id int not null,
time datetime null
)
comment '选课记录';
然后,向 2 张表中插入一些数据
# 学生表数据
1,张三,18
2,李四,23
3,王五,30
4,马六,35
5,孙七,40
6,朱八,19
7,黄九,53
# 记录表数据
2021001,语文,1,2021-01-18 15:32:47
2021002,数学,2,2021-01-18 15:33:41
2021003,英语,3,2021-01-18 15:34:01
2021004,物理,4,2021-01-18 15:34:33
2021005,体育,5,2021-01-18 15:34:47
2021006,化学,8,2021-01-18 15:35:12
2021007,生物,9,2021-01-18 15:35:39
2021008,音乐,10,2021-01-18 15:36:00
子查询,又称之为内查询,是一种嵌套在其他 Sql 查询的 Where 子句中的查询
一般用于对查询结果的进一步限制,返回所需要的数据;子查询可以用在 SELECT、INSERT、UPDATE 和 DELETE 语句中
这里以 SELECT 语句为例,在两张表中使用子查询,筛选出满足条件的记录
# 子查询
select * from student where id in (select student_id from record where student_id<=3)
查询结果如下:
# 子查询的结果
1,张三,18
2,李四,23
需要注意的是,子查询必须包含在圆括号内,并且不能使用 ORDER BY 进行排序
内连接是通过关键字 inner join 连接两张表,只返回满足 on 条件的,两张表的交集数据
# 内连接
select * from student s inner join record r on s.id=r.student_id;
查询结果如下:
# 内连接查询结果
1,张三,18,2021001,语文,1,2021-01-18 15:32:47
2,李四,23,2021002,数学,2,2021-01-18 15:33:41
3,王五,30,2021003,英语,3,2021-01-18 15:34:01
4,马六,35,2021004,物理,4,2021-01-18 15:34:33
5,孙七,40,2021005,体育,5,2021-01-18 15:34:47
需要注意的是,如果内连接没有通过 on 关键字指定条件的话,查询结果和交叉连接查询结果一样,只是执行效率高于交叉连接
外连接包含:
左外连接
右外连接
其中,
左外连接:使用关键字 left join,以左表为准,返回左表的所有数据,右表满足 on 条件的数据会全部显示,否则用 null 值去填充
右外连接:和左外连接相反。使用关键 right join,以右表为准,返回右表的所有数据,左表满足 on 条件的数据会全部显示,否则用 null 值去填充
首先,我们来看左连接的实例
# 左外连接
select * from student s left join record r on s.id=r.student_id;
返回结果如下:
# 左外连接结果
1,张三,18,2021001,语文,1,2021-01-18 15:32:47
2,李四,23,2021002,数学,2,2021-01-18 15:33:41
3,王五,30,2021003,英语,3,2021-01-18 15:34:01
4,马六,35,2021004,物理,4,2021-01-18 15:34:33
5,孙七,40,2021005,体育,5,2021-01-18 15:34:47
6,朱八,19,NULL,NULL,NULL,NULL
7,黄九,53,NULL,NULL,NULL,NULL
然后,我们再来看看右连接
# 右外连接
select * from student s right join record r on s.id=r.student_id;
返回结果如下:
# 右外连接结果
1,张三,18,2021001,语文,1,2021-01-18 15:32:47
2,李四,23,2021002,数学,2,2021-01-18 15:33:41
3,王五,30,2021003,英语,3,2021-01-18 15:34:01
4,马六,35,2021004,物理,4,2021-01-18 15:34:33
5,孙七,40,2021005,体育,5,2021-01-18 15:34:47
NULL,NULL,NULL,2021006,化学,8,2021-01-18 15:35:12
NULL,NULL,NULL,2021007,生物,9,2021-01-18 15:35:39
NULL,NULL,NULL,2021008,音乐,10,2021-01-18 15:36:00
完全连接,是通过关键字 full join 连接两张表,返回左表和右表的所有数据,并使用 null 值填充缺失的数据
# 完全连接
select * from student s full join record r on s.id = r.student_id;
需要注意的是,Mysql 并不支持完全连接,我们可以使用左连接 + union + 右连接的方式去模拟完全连接
select * from student left join record on student.id = record.student_id
union
select * from student right join record on student.id = record.student_id;
查询结果如下:
# 完全连接结果
1,张三,18,2021001,语文,1,2021-01-18 15:32:47
2,李四,23,2021002,数学,2,2021-01-18 15:33:41
3,王五,30,2021003,英语,3,2021-01-18 15:34:01
4,马六,35,2021004,物理,4,2021-01-18 15:34:33
5,孙七,40,2021005,体育,5,2021-01-18 15:34:47
6,朱八,19,NULL,NULL,NULL,NULL
7,黄九,53,NULL,NULL,NULL,NULL
NULL,NULL,NULL,2021006,化学,8,2021-01-18 15:35:12
NULL,NULL,NULL,2021007,生物,9,2021-01-18 15:35:39
NULL,NULL,NULL,2021008,音乐,10,2021-01-18 15:36:00
交叉连接,又称之为笛卡尔积,使用关键字 cross join 连接两张表进行查询
如果不使用 where 加入限制条件,则返回两张表行数的乘积;如果加入限制条件,则返回满足条件表达式的数据并合成一行
以加入限制条件的交叉连接查询为例
# 交叉连接
select * from xag.student as s cross join xag.record as r where s.id=r.student_id;
查询结果如下:
# 交叉连接结果
1,张三,18,2021001,语文,1,2021-01-18 15:32:47
2,李四,23,2021002,数学,2,2021-01-18 15:33:41
3,王五,30,2021003,英语,3,2021-01-18 15:34:01
4,马六,35,2021004,物理,4,2021-01-18 15:34:33
5,孙七,40,2021005,体育,5,2021-01-18 15:34:47
需要注意的是,交叉连接查询如果带有限制条件,它会先生成两张表行数成绩生成查询结果集,然后再通过限制条件去过滤;因此,在数据量大的时候,查询速度会很慢
相比单表查询,多表查询可以覆盖更多业务场景,大大提升我们的工作效率!实际工作当中,可以根据需要选择性的去使用!
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Python数据分析中,Pandas库的DataFrame是最核心、最常用的结构化数据表对象,类似于Excel的二维表格,具备规整的行列结构、字 ...
2026-09-07在数据分析、经营复盘、业绩预测与经济统计工作中,平均增速(平均增长率)是衡量数据长期变化趋势、业务发展快慢的核心指标。不 ...
2026-09-07 很多数据分析师精通Excel单元格操作,但当被问到“表结构数据的基本处理单位是什么”“字段和记录的本质区别”“为什么表结 ...
2026-09-07随着大数据技术的快速发展,商业竞争逐步从传统的经验式经营转变为数据驱动的精细化运营。海量的用户行为数据、交易数据、运营数 ...
2026-09-04CDA数据分析师 出品 作者:李诗怡 1. 波士顿矩阵(BCG Matrix) 定义: BCG于1970年提出的业务组合分析工具,以"市场增长率"(纵 ...
2026-09-04 数据分析师八成以上的时间在和数据表格打交道,但许多人拿到Excel后习惯性地先算、先分析,结果回头发现漏了一列关键数据, ...
2026-09-04数据透视表是Excel与Power BI中最核心的数据分析工具,具备快速汇总、维度拆分、动态筛选的能力,可高效完成数据归类与统计展示 ...
2026-09-03在Power BI数据分析可视化场景中,堆积柱状图+折线图是最常用的复合图表组合。堆积柱状图适合展示各细分维度当期数值、结构占比 ...
2026-09-03 很多数据分析师每天与Excel打交道,但当被问到“表格结构数据的基本处理单位是什么”“数据类型误判会引发哪些分析错误”“ ...
2026-09-03CDA数据分析师 出品 作者:李诗怡 一、8个核心数据清洗函数 1. TRIM:一键清除多余空格(最常用) 作用:仅保留文本中"单词/字 ...
2026-09-02数据分析的核心并非单纯操作工具、整理报表或绘制图表,而是依靠科学的思维逻辑挖掘数据价值、解释业务现象、指导经营决策。在完 ...
2026-09-02在社会经济、产业研究、区域治理与大数据实证分析中,面板数据是最具研究价值的数据类型。面板数据同时包含截面维度与时间维度信 ...
2026-09-02 很多数据分析师能熟练计算均值、标准差,但当被问到“如何用一张图让业务方3秒内看懂核心结论”“面对不同数据类型该怎么选 ...
2026-09-02在数据驱动决策的体系中,数据分析按照分析目的可分为描述性分析、诊断性分析、预测性分析与指导性分析四大类型。其中,诊断性分 ...
2026-09-01网络请求是Python爬虫开发、接口测试、数据拉取的核心基础功能,Python生态中主要依靠 urllib 和 requests 两大库实现HTTP请求操 ...
2026-09-01 很多数据分析师面对业务问题时,常常感到“知道要分析,却不知道用什么方法”。其实,数据分析并非无章可循——从三大基础范 ...
2026-09-01在数据库设计与业务数据维护中,自增ID是数据表最常用的主键字段,用于唯一标识每一条业务数据,正常状态下ID应保持连续递增。但 ...
2026-08-31在数理统计、数据分析、经济测算与日常量化评估中,平均值是刻画数据集中趋势、反映整体水平的基础核心指标。在实际应用中,最常 ...
2026-08-31在数据驱动的时代,数据分析早已不是“凭经验、靠感觉”的零散操作,而是一套具备固定逻辑、标准化流程的系统方法——这就是数据 ...
2026-08-31在大数据时代背景下,海量行业数据亟需通过专业化工具挖掘潜在价值,辅助企业业务决策、优化运营模式、规避经营风险。Python凭借 ...
2026-08-28