浅谈SQL Server中的三种物理连接操作

发表于:2013-1-14 10:12

字体: | 上一篇 | 下一篇 | 我要投稿

 作者:宋沄剑    来源:51Testing软件测试网采编

分享:

  合并连接(Merge Join)

  谈到合并连接,我突然想起在西雅图参加SQL Pass峰会晚上酒吧排队点酒,由于我和另外一哥们站错了位置,貌似我们两个在插队一样,我赶紧说:I’m sorry,i thought here is end of line。对方无不幽默的说:”It’s OK,In SQL Server,We called it merge join”。

  由上面的小故事不难看出,Merge Join其实上就是将两个有序队列进行连接,需要两端都已经有序,所以不必像Loop Join那样不断的查找循环内部的表。其次,Merge Join需要表连接条件中至少有一个等号查询分析器才会去选择Merge Join。

  Merge Join的过程我们可以简单用下面图进行描述:

图8.Merge Join第一步

  Merge Join首先从两个输入集合中各取第一行,如果匹配,则返回匹配行。加入两行不匹配,则有较小值的输入集合+1,如图9所示。

图9.更小值的输入集合向下进1

  用C#代码表示Merge Join的话如代码1所示。

  1. public class MergeJoin  
  2. {  
  3.     // Assume that left and right are already sorted  
  4.     public static Relation Sort(Relation left, Relation right)  
  5.     {  
  6.         Relation output = new Relation();  
  7.         while (!left.IsPastEnd() && !right.IsPastEnd())  
  8.         {  
  9.             if (left.Key == right.Key)  
  10.             {  
  11.                 output.Add(left.Key);  
  12.                 left.Advance();  
  13.                 right.Advance();  
  14.             }  
  15.             else if (left.Key < right.Key)  
  16.                 left.Advance();  
  17.             else //(left.Key > right.Key)  
  18.                 right.Advance();  
  19.         }  
  20.         return output;  
  21.     }  
  22. }

  代码1.Merge Join的C#代码表示

  因此,通常来说Merge Join如果输入两端有序,则Merge Join效率会非常高,但是如果需要使用显式Sort来保证有序实现Merge Join的话,那么Hash Join将会是效率更高的选择。但是也有一种例外,那就是查询中存在order by,group by,distinct等可能导致查询分析器不得不进行显式排序,那么对于查询分析器来说,反正都已经进行显式Sort了,何不一石二鸟的直接利用 Sort后的结果进行成本更小的MERGE JOIN?在这种情况下,Merge Join将会是更好的选择。

53/5<12345>
重磅发布,2022软件测试行业现状调查报告~

关注51Testing

联系我们

快捷面板 站点地图 联系我们 广告服务 关于我们 站长统计

法律顾问:上海兰迪律师事务所 项棋律师
版权所有 上海博为峰软件技术股份有限公司 Copyright©51testing.com 2003-2023
投诉及意见反馈:webmaster@51testing.com; 业务联系:service@51testing.com 021-64471599-8017

沪ICP备05003035号

沪公网安备 31010102002173号