GROUP BY和DISTINCT有什么区别吗

前几天我学了一些关于SQL的简单知识:

SELECT c FROM myTbl GROUP BY C

结果与:

SELECT DISTINCT C FROM myTbl

我好奇的是，SQL引擎处理命令的方式有什么不同，还是它们真的是一样的东西?

我个人更喜欢独特的语法，但我相信这更多是出于习惯而不是其他原因。

编辑:这不是一个关于聚合的问题。理解了GROUP BY与聚合函数的使用。

当前回答

在Hive (HQL)中，GROUP BY可以比DISTINCT快得多，因为前者不需要比较表中的所有字段。

参见:https://sqlperformance.com/2017/01/t-sql-queries/surprises-assumptions-group-by-distinct。

2018-07-01 19:08:26

其他回答

我对它的理解是，使用distinct就相当于按照所选字段的顺序对它们进行分组。

i.e:

select distinct a, b, c from table;

等于:

select a, b, c from table group by a, b, c

2008-10-02 21:05:41

你之所以注意到这一点，是因为你只选择了一列。

尝试选择两个字段，看看会发生什么。

Group By的用法如下:

SELECT name, SUM(transaction) FROM myTbl GROUP BY name

这将显示每个人的所有交易的总和。

2008-10-02 20:16:27

除了聚合函数的使用外，group by子句和distinct子句之间没有显著区别。两者都可以用来区分值，但如果在性能的角度组由更好。在使用distinct关键字时，内部采用排序操作，可在执行计划中查看。

试试简单的例子

Declare @tmpresult table
(
  Id tinyint
)

Insert into @tmpresult
Select 5
Union all
Select 2
Union all
Select 3
Union all
Select 4


Select distinct 
Id
From @tmpresult

2015-02-10 16:56:21

当你指的是DISTINCT时，请不要使用GROUP BY，即使它们的工作方式是一样的。我假设您正在尝试从查询中减少毫秒数，我必须指出，开发人员的时间比计算机的时间要昂贵几个数量级。

2008-10-02 20:57:40

对于你发布的查询，它们是相同的。但对于其他查询，这可能不是真的。

例如，它不等同于:

SELECT C FROM myTbl GROUP BY C, D

2008-10-02 20:11:37

GROUP BY和DISTINCT有什么区别吗

推荐文章

最新文章

标签