• sql 多表查询


    一、基础

    1.1 SQL查询的基本原理

    第一、单表查询:根据WHERE条件过滤表中的记录,形成中间表(这个中间表对用户是不可见的);然后根据SELECT的选择列选择相应的列进行返回最终结果。
    第二、两表连接查询:对两表求积(笛卡尔积)并用ON条件和连接连接类型进行过滤形成中间表;然后根据WHERE条件过滤中间表的记录,并根据SELECT指定的列返回查询结果。
    第三、多表连接查询:先对第一个和第二个表按照两表连接做查询,然后用查询结果和第三个表做连接查询,以此类推,直到所有的表都连接上为止,最终形成一个中间的结果表,然后根据WHERE条件过滤中间表的记录,并根据SELECT指定的列返回查询结果。
    理解SQL查询的过程是进行SQL优化的理论依据。

    1.2 ON后面的条件(ON条件)和WHERE条件的区别

    ON条件:
    是过滤两个链接表笛卡尔积形成中间表的约束条件。
    WHERE条件:
    在有ON条件的SELECT语句中是过滤中间表的约束条件。
    在没有ON的单表查询中,是限制物理表或者中间查询结果返回记录的约束。
    在两表或多表连接中是限制连接形成最终中间表的返回结果的约束。
    从这里可以看出,将WHERE条件移入ON后面是不恰当的。推荐的做法是:ON只进行连接操作,WHERE只过滤中间表的记录。

    二、连接查询

    连接运算符是用来实现多表联合查询的一种重要方式,主要分为三种:内连接、外连接、交叉连接。

    2.1 内连接 INNER JOIN

    内连接(INNER JOIN)有两种,显式的和隐式的,返回连接表中符合连接条件和查询条件的数据行。(所谓的链接表就是数据库在做查询形成的中间表)。

    内连接使用比较运算符(包括=、>、<、<>、>=、<=、!> 和!<)进行表间的比较操作,查询与连接条件相匹配的数据。根据所使用的比较方式不同,内连接分为等值连接、自然连接和自连接三种。

    语句1:隐式的内连接,没有INNER JOIN,形成的中间表为两个表的笛卡尔积。
    SELECT O.ID,O.ORDER_NUMBER,C.ID,C.NAME
    FROM CUSTOMERS C,ORDERS O
    WHERE C.ID=O.CUSTOMER_ID;

    语句2:显示的内连接,一般称为内连接,有INNER JOIN,形成的中间表为两个表经过ON条件过滤后的笛卡尔积。
    SELECT O.ID,O.ORDER_NUMBER,C.ID,C.NAME
    FROM CUSTOMERS C INNER JOIN ORDERS O ON C.ID=O.CUSTOMER_ID;

    等值连接

    使用”=”关系将表连接起来的查询,其查询结果中列出被连接表中的所有,包括其中的重复列

    1 SELECT
    2     PM_ACT_JOB_RLS.*, PM_ACT_RLS.*
    3 FROM
    4     PM_ACT_JOB_RLS
    5 INNER JOIN PM_ACT_RLS ON PM_ACT_JOB_RLS.RlsPK = PM_ACT_RLS.RlsPK

    自然连接

    等值连接中去掉重复的列,形成的连接。

    说真的,这种连接查询没有存在的价值,既然是SQL2标准中定义的,就给出个例子看看吧。自然连接无需指定连接列,SQL会检查两个表中是否相同名称的列,且假设他们在连接条件中使用,并且在连接条件中仅包含一个连接列。不允许使用ON语句,不允许指定显示列,显示列只能用*表示(ORACLE环境下测试的)。对于每种连接类型(除了交叉连接外),均可指定NATURAL。

    1 SELECT
    2 PM_ACT_JOB_RLS.JobPK, PM_ACT_RLS.RlsPK, RlsName 
    3 FROM 
    4 PM_ACT_JOB_RLS 
    5 Natural INNER JOIN PM_ACT_RLS ON PM_ACT_JOB_RLS.RlsPK = PM_ACT_RLS.RlsPK

    语句1:
    SELECT *
    FROM ORDERS O NATURAL INNER JOIN CUSTOMERS C;

    语句2:
    SELECT *
    FROM ORDERS O NATURAL LEFT OUTER JOIN CUSTOMERS C;

    语句3:
    SELECT *
    FROM ORDERS O NATURAL RIGHT OUTER JOIN CUSTOMERS C;

    语句4:
    SELECT *
    FROM ORDERS O NATURAL FULL OUTER JOIN CUSTOMERS C;

    自连接

     如果在一个连接查询中,设计到的两个表都是同一个表,这种查询称为自连接查询。

    1 --c1、c2逻辑上是两张表,物理上是一张表 SELECT
    2     c1.CategoryID,
    3     c1.CategoryName
    4 FROM
    5     [dbo].[Category] c1
    6 INNER JOIN [dbo].[Category] c2 ON c1.[CategoryID] = c2.[ParentID]

    联合连接(UNION JOIN)

    这是一种很少见的连接方式。Oracle、MySQL均不支持,其作用是:找出全外连接和内连接之间差异的所有行。这在数据分析中排错中比较常用。也可以利用数据库的集合操作来实现此功能。
    语句1:联合查询(UNION JOIN)例句,还没有找到能执行的SQL环境。
    SELECT1 O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O UNION JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID

    语句2:语句11在DB2下的等价实现。还不知道DB2是否支持语句11呢!
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O FULL OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
    EXCEPT
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O INNER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;

    语句3:语句1在Oracle下的等价实现。
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O FULL OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
    MINUS
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O INNER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;

    2.2 外连接

    内连接只返回满足连接条件的数据行,外连接不只列出与连接条件相匹配的行,而是列出左表(左外连接时)、右表(右外连接时)或两个表(全外连接时)中所有符合搜索条件的数据行。

    外连接分为左外连接、右外链接、全外连接三种。

    1)LEFT JOIN或LEFT OUTER JOIN 
    左向外联接的结果集包括 LEFT OUTER子句中指定的左表的所有行,而不仅仅是联接列所匹配的行。如果左表的某行在右表中没有匹配行,则在相关联的结果集行中右表的所有选择列表列均为空值。 
    2)RIGHT JOIN 或 RIGHT OUTER JOIN 
    右向外联接是左向外联接的反向联接。将返回右表的所有行。如果右表的某行在左表中没有匹配行,则将为左表返回空值。 
    3)FULL JOIN 或 FULL OUTER JOIN
    完整外部联接返回左表和右表中的所有行。当某行在另一个表中没有匹配行时,则另一个表的选择列表列包含空值。如果表之间有匹配行,则整个结果集行包含基表的数据值。

    语句1:左外连接(LEFT OUTER JOIN)
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;

    语句2:右外连接(RIGHT OUTER JOIN)
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O RIGHT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
    注意:WHERE条件放在ON后面查询的结果是不一样的。例如:

    语句3:WHERE条件独立。
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
    WHERE O.ORDER_NUMBER<>'MIKE_ORDER001';

    语句4:将语句7中的WHERE条件放到ON后面。
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID AND O.ORDER_NUMBER<>'MIKE_ORDER001';

    从语句3和语句4查询的结果来看,显然是不相同的,语句8显示的结果是难以理解的。因此,推荐在写连接查询的时候,ON后面只跟连接条件,而对中间表限制的条件都写到WHERE子句中。

    全外连接(FULL OUTER JOIN)

    注意:MySQL是不支持全外的连接的,这里给出的写法适合Oracle和DB2。但是可以通过左外和右外求合集来获取全外连接的查询结果。
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O FULL OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;

    左外和右外的合集

    实际上查询结果和上面的全外连接语句是相同的
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
    UNION
    SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
    FROM ORDERS O RIGHT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;

    2.3 交叉连接

    交叉连接(CROSS JOIN):有两种,显式的和隐式的。不带ON子句,返回的是两表的乘积,也叫笛卡尔积。

    语句1:隐式的交叉连接,没有CROSS JOIN。
    SELECT O.ID, O.ORDER_NUMBER, C.ID, C.NAME
    FROM ORDERS O , CUSTOMERS C
    WHERE O.ID=1;

    语句2:显式的交叉连接,使用CROSS JOIN。
    SELECT O.ID,O.ORDER_NUMBER,C.ID,
    C.NAME
    FROM ORDERS O CROSS JOIN CUSTOMERS C
    WHERE O.ID=1;
    语句1和语句2的结果是相同的

    3 例子

    (一) 示例1

    a表 b表
    id name id job parent_id
    1 张3 1 23 1
    2 李四 2 34 2
    3 王武 3 34 4

    1) 内连接 
    select a.*,b.* from a inner join b on a.id=b.parent_id 
    结果是 
    1 张3 1 23 1 
    2 李四 2 34 2 

    2)左连接 
    select a.*,b.* from a left join b on a.id=b.parent_id 
    结果是 
    1 张3 1 23 1 
    2 李四 2 34 2 
    3 王武 null 

    3) 右连接 
    select a.*,b.* from a right join b on a.id=b.parent_id 
    结果是 
    1 张3 1 23 1 
    2 李四 2 34 2 
    null 3 34 4 

    4) 完全连接 
    select a.*,b.* from a full join b on a.id=b.parent_id 
    结果是 
    1 张3 1 23 1 
    2 李四 2 34 2 
    null    3 34 4 
    3 王武 null

    (二) 示例2

    数据库版本:Oracle

    表TESTA,TESTB,TESTC,各有A, B两列

    A.内连接

    内连接,即最常见的等值连接,例:

    SELECT 
    FROM TESTA,TESTB
    WHERE TESTA.A=TESTB.A

    结果:

    B.外连接

    外连接分为左外连接,右外连接和全外连接。

    1.  左外连接 left outer join 或者 left join

    左外连接就是在等值连接的基础上加上主表中的未匹配数据,例:

    SELECT *
    FROM TESTA 
    LEFT OUTER JOIN TESTB 
    ON TESTA.A=TESTB.A

    结果:

    三个表做左外链接:

    SELECT *
    FROM TESTA 
    LEFT OUTER JOIN TESTB 
    ON TESTA.A=TESTB.A
    LEFT OUTER JOIN TESTC
    ON TESTA.A=TESTC.A
     

    2. 右外连接 right outer join 或者 right join

    右外连接是在等值连接的基础上加上被连接表的不匹配数据

    SELECT *
    FROM TESTA 
    RIGHT OUTER JOIN TESTB 
    ON TESTA.A=TESTB.A

    3.全外连接 full outer join 或者 full join

    全外连接是在等值连接的基础上将左表和右表的未匹配数据都加上。

    SELECT 
    FROM TESTA 
    FULL OUTER JOIN TESTB
    ON TESTA.A=TESTB.A
     

    二、总结

    (1)内、外连接的区别

    仅从定义上看,就可以清晰的分辨出了。

    内连接:指连接结果仅包含符合连接条件的行,参与连接的两个表都应该符合连接条件。也就是,返回2个表中完全符合条件的记录,结果集中每个表的字段内容均来自各自的表。

    外连接:连接结果不仅包含符合连接条件的行,同时也包含自身不符合条件的行。包括左外连接、右外连接和全外连接。也就是,返回2个表中完全符合条件的记录,再加上2个表中各自的记录,结果集中的字段只有一个表中有记录时,另一个表中的字段均使用空值null填写。

    (2)两表连接查询时,选择哪种查询的依据

    连接查询是SQL查询的核心,连接查询的连接类型选择依据实际需求。如果选择不当,非但不能提高查询效率,反而会带来一些逻辑错误或者性能低下。
    1、 查两表关联列相等的数据用内连接。
    2、 Col_L是Col_R的子集时用右外连接。
    3、 Col_R是Col_L的子集时用左外连接。
    4、 Col_R和Col_L彼此有交集但彼此互不为子集时候用全外。
    5、 求差操作的时候用联合查询。
    多个表查询的时候,这些不同的连接类型可以写到一块。例如:
    SELECT T1.C1,T2.CX,T3.CY
    FROM TAB1 T1
    INNER JOIN TAB2 T2 ON (T1.C1=T2.C2)
    INNER JOIN TAB3 T3 ON (T1.C1=T2.C3)
    LEFT OUTER JOIN TAB4 ON(T2.C2=T3.C3);
    WHERE T1.X >T3.Y;
    上面这个SQL查询是多表连接的一个示范。

    参考文章

    【SQL】—多表查询的几种连接方式

    SQL语句 之 数据查询(二)多表查询-----------------数据查询的重点 难点

    sql 内连接、外连接、自然连接等各种连接

    数据库的内连接和外连接有什么区别?Daicx19。

  • 相关阅读:
    chrome更新后,恢复本地丢失的书签和历史记录
    redis 集合set 使用 rediscluster 使用交集
    git 删除分支恢复
    SQL语句性能优化
    A调用B,b有事务,a没有
    Unable to tunnel through proxy. Proxy returns "HTTP/1.0 407 Proxy Authentica 问题处理
    fasnjson 转换
    String.format()的详细用法
    传递json
    基础入门-加密编码算法
  • 原文地址:https://www.cnblogs.com/zhilu/p/15703333.html
Copyright © 2020-2023  润新知