SQL仅选择列上具有最大值的行

我有一张文件表（此处为简化版）：

id	rev	content
1	1	...
2	1	...
1	2	...
1	3	...

如何为每个id选择一行，并且仅选择最大的rev？对于上面的数据，结果应该包含两行：[1，3，…]和[2，1，…]。我使用的是MySQL。

目前，我在while循环中使用检查来检测和重写结果集中的旧版本。但这是实现结果的唯一方法吗？没有SQL解决方案吗？

当前回答

我会用这个：

select t.*
from test as t
join
   (select max(rev) as rev
    from test
    group by id) as o
on o.rev = t.rev

子查询SELECT可能不太有效，但在JOIN子句中似乎是可用的。我不是优化查询的专家，但我在MySQL、PostgreSQL和FireBird上都做过尝试，而且效果非常好。

您可以在多个联接中使用此模式，也可以使用WHERE子句。这是我的工作示例（用表格“firmy”解决与您相同的问题）：

select *
from platnosci as p
join firmy as f
on p.id_rel_firmy = f.id_rel
join (select max(id_obj) as id_obj
      from firmy
      group by id_rel) as o
on o.id_obj = f.id_obj and p.od > '2014-03-01'

这是在有十几张唱片的桌子上被要求的，在不太强的机器上只需要不到0.01秒的时间。

我不会使用IN子句（如上所述）。IN用于常量的短列表，而不是构建在子查询上的查询过滤器。这是因为in中的子查询是针对每个扫描的记录执行的，这可能会使查询花费很长时间。

2015-03-04 18:12:10

其他回答

按相反顺序对rev字段进行排序，然后按id进行分组，每个分组的第一行是rev值最高的一行。

SELECT * FROM (SELECT * FROM table1 ORDER BY id, rev DESC) X GROUP BY X.id;

测试时间：http://sqlfiddle.com/具有以下数据

CREATE TABLE table1
    (`id` int, `rev` int, `content` varchar(11));

INSERT INTO table1
    (`id`, `rev`, `content`)
VALUES
    (1, 1, 'One-One'),
    (1, 2, 'One-Two'),
    (2, 1, 'Two-One'),
    (2, 2, 'Two-Two'),
    (3, 2, 'Three-Two'),
    (3, 1, 'Three-One'),
    (3, 3, 'Three-Three')
;

这在MySql 5.5和5.6中给出了以下结果

id  rev content
1   2   One-Two
2   2   Two-Two
3   3   Three-Two

2015-12-11 03:14:18

我用下面的方法解决了我自己的问题。我首先创建了一个临时表，并插入了每个唯一id的最大rev值。

CREATE TABLE #temp1
(
    id varchar(20)
    , rev int
)
INSERT INTO #temp1
SELECT a.id, MAX(a.rev) as rev
FROM 
    (
        SELECT id, content, SUM(rev) as rev
        FROM YourTable
        GROUP BY id, content
    ) as a 
GROUP BY a.id
ORDER BY a.id

然后，我将这些最大值（#temp1）加入到所有可能的id/内容组合中。通过这样做，我很自然地过滤掉了非最大id/内容组合，并且只剩下每个组合的最大rev值。

SELECT a.id, a.rev, content
FROM #temp1 as a
LEFT JOIN
    (
        SELECT id, content, SUM(rev) as rev
        FROM YourTable
        GROUP BY id, content
    ) as b on a.id = b.id and a.rev = b.rev
GROUP BY a.id, a.rev, b.content
ORDER BY a.id

2018-01-05 10:51:51

下面是另一个解决方案，用于仅检索具有该字段最大值的字段的记录。这适用于我工作的平台SQL400。在本例中，字段FIELD5中具有最大值的记录将由以下SQL语句检索。

SELECT A.KEYFIELD1, A.KEYFIELD2, A.FIELD3, A.FIELD4, A.FIELD5
  FROM MYFILE A
 WHERE RRN(A) IN
   (SELECT RRN(B) 
      FROM MYFILE B
     WHERE B.KEYFIELD1 = A.KEYFIELD1 AND B.KEYFIELD2 = A.KEYFIELD2
     ORDER BY B.FIELD5 DESC
     FETCH FIRST ROW ONLY)

2017-10-16 23:48:32

乍一看。。。

您只需要一个带有MAX聚合函数的GROUP BY子句：

SELECT id, MAX(rev)
FROM YourTable
GROUP BY id

从来没有这么简单，是吗？

我刚刚注意到你也需要内容栏。

这是SQL中一个非常常见的问题：在每个组标识符的列中查找具有某个最大值的行的整个数据。在我的职业生涯中我听过很多。事实上，这是我在当前工作的技术面试中回答的问题之一。

事实上，StackOverflow社区创建了一个标签来处理这样的问题是非常常见的：每个组中最优秀的一个。

基本上，有两种方法可以解决这个问题：

使用简单组标识符连接，组子查询中的最大值

在这种方法中，首先在子查询中找到组标识符，即组中的最大值（上面已经解决）。然后，将表连接到子查询，组标识符和组中的最大值相等：

SELECT a.id, a.rev, a.contents
FROM YourTable a
INNER JOIN (
    SELECT id, MAX(rev) rev
    FROM YourTable
    GROUP BY id
) b ON a.id = b.id AND a.rev = b.rev

左侧使用自身连接，调整连接条件和过滤器

在这种方法中，您可以将表与自身连接起来。组标识符中包含相等项。然后，两个聪明的动作：

第二个连接条件的左侧值小于右侧值执行步骤1时，实际具有最大值的行的右侧将为NULL（这是一个LEFT JOIN，记得吗？）。然后，我们过滤合并结果，只显示右侧为NULL的行。

所以你最终会得到：

SELECT a.*
FROM YourTable a
LEFT OUTER JOIN YourTable b
    ON a.id = b.id AND a.rev < b.rev
WHERE b.id IS NULL;

结论

这两种方法带来的结果完全相同。

如果组标识符的组中有两行具有最大值，则两种方法中的结果都是这两行。

这两种方法都与SQLANSI兼容，因此，无论其“味道”如何，都可以与您喜爱的RDBMS一起使用。

这两种方法都是性能友好的，但是您的里程可能会有所不同（RDBMS、DB结构、索引等）。确保你选择对你最有意义的那一个。

2011-10-12 19:43:53

这是一个很好的方法

使用以下代码：

with temp as  ( 
select count(field1) as summ , field1
from table_name
group by field1 )
select * from temp where summ = (select max(summ) from temp)

2015-01-07 11:36:08

SQL仅选择列上具有最大值的行

推荐文章

最新文章

标签