GROUP BY和DISTINCT有什么区别吗

前几天我学了一些关于SQL的简单知识:

SELECT c FROM myTbl GROUP BY C

结果与:

SELECT DISTINCT C FROM myTbl

我好奇的是，SQL引擎处理命令的方式有什么不同，还是它们真的是一样的东西?

我个人更喜欢独特的语法，但我相信这更多是出于习惯而不是其他原因。

编辑:这不是一个关于聚合的问题。理解了GROUP BY与聚合函数的使用。

当前回答

功能效率是完全不同的。如果你想只选择“返回值”，除了重复的一个，使用distinct比group by更好。因为“group by”包括(排序+删除)，“distinct”包括(删除)

2018-01-09 04:40:49

其他回答

我阅读了上面所有的评论，但除了聚合位之外，没有看到任何人指出Group By和Distinct之间的主要区别。

Distinct返回所有行，然后重复删除它们，而Group By则在算法逐条读取时重复删除行。

这意味着它们可以产生不同的结果!

例如，下面的代码会产生不同的结果:

SELECT distinct ROW_NUMBER() OVER (ORDER BY Name), Name FROM NamesTable

 SELECT ROW_NUMBER() OVER (ORDER BY Name), Name FROM NamesTable
GROUP BY Name

如果表中有10个名字，其中一个是另一个的副本，那么第一个查询返回10行，而第二个查询返回9行。

原因就是我上面说的，这样他们就能表现得不一样!

2012-05-17 16:04:57

当你指的是DISTINCT时，请不要使用GROUP BY，即使它们的工作方式是一样的。我假设您正在尝试从查询中减少毫秒数，我必须指出，开发人员的时间比计算机的时间要昂贵几个数量级。

2008-10-02 20:57:40

从“SQL语言”的角度来看，这两种结构是等价的，你选择哪一种是我们都必须做出的“生活方式”选择之一。我认为DISTINCT更明确(因此对继承你代码的人更体贴)是一个很好的例子，但这并不意味着GROUP BY结构是一个无效的选择。

我认为“GROUP BY是用于聚合的”是错误的重点。人们应该意识到set函数(MAX, MIN, COUNT等)可以省略，这样他们就可以理解编码器的意图。

理想的优化器将识别等效的SQL结构，并始终相应地选择理想的计划。对于现实生活中选择的SQL引擎，您必须测试:)

PS注意DISTINCT关键字在select子句中的位置可能会产生不同的结果，例如对比:

SELECT COUNT(DISTINCT C) FROM myTbl;

SELECT DISTINCT COUNT(C) FROM myTbl;

2008-10-03 10:09:12

GROUP BY允许您使用聚合函数，如AVG、MAX、MIN、SUM和COUNT。另一方面，DISTINCT只是删除重复项。

例如，如果你有一堆购买记录，你想知道每个部门花了多少钱，你可能会这样做:

SELECT department, SUM(amount) FROM purchases GROUP BY department

这将为每个部门提供一行，其中包含部门名称和该部门所有行中所有金额值的总和。

2008-10-02 20:10:58

GROUP BY有一个非常具体的含义，它与distinct函数不同。

GROUP BY使用选择的表达式对查询结果进行分组，然后可以应用聚合函数，这些函数将作用于每个组，而不是整个结果集。

这里有一个例子可能会有所帮助:

给定一个这样的表:

name
------
barry
dave
bill
dave
dave
barry
john

这个查询:

SELECT name, count(*) AS count FROM table GROUP BY name;

将产生如下输出:

name    count
-------------
barry   2
dave    3
bill    1
john    1

这显然与使用DISTINCT非常不同。如果您想对结果进行分组，请使用group BY，如果您只想要特定列的唯一列表，请使用DISTINCT。这将使数据库有机会根据您的需要优化查询。

2008-10-02 20:20:31

GROUP BY和DISTINCT有什么区别吗

推荐文章

最新文章

标签