在MySQL的实际业务查询中,我们经常会遇到不需要对所有查询字段进行完整GROUP BY分组,仅需要对部分字段去重后统计对应指标的不完全分组统计需求,这类需求可以通过DISTINCT关键字和聚合函数配合使用来实现。

核心实现逻辑
不完全分组统计的核心思路是,先通过DISTINCT对需要去重的字段进行去重处理,再将去重后的结果作为聚合函数的计算对象,或者直接在使用聚合函数时搭配DISTINCT关键字,实现对去重后数据的统计。
需要注意的是,DISTINCT关键字会对后面跟随的所有字段组合进行去重,而聚合函数搭配DISTINCT时,仅会对传入聚合函数的字段值去重后再计算。
常见使用场景与示例
1. 单字段去重后计数
假设我们有一张用户订单表user_order,表结构如下:
CREATE TABLE user_order (
order_id INT PRIMARY KEY,
user_id INT,
product_id INT,
order_amount DECIMAL(10,2),
order_date DATE
);
如果需要统计有多少个不同的用户下过订单,不需要按照其他字段分组,仅需要对user_id去重后计数,就可以使用以下语句:
-- 方法1:先去重再计数 SELECT COUNT(*) AS distinct_user_count FROM (SELECT DISTINCT user_id FROM user_order) AS temp; -- 方法2:COUNT函数内直接使用DISTINCT SELECT COUNT(DISTINCT user_id) AS distinct_user_count FROM user_order;
2. 多字段组合去重后统计
如果需要统计每个用户购买过多少种不同的商品,也就是按照user_id分组,对product_id去重后计数,属于典型的不完全分组场景,user_id是分组维度,product_id是去重统计维度:
SELECT
user_id,
COUNT(DISTINCT product_id) AS distinct_product_count
FROM user_order
GROUP BY user_id;
3. 去重后求和统计
假设订单表中存在同一用户同一商品的重复下单记录,现在需要统计每个用户实际购买的不同商品的总金额,也就是先对user_id和product_id组合去重,再对order_amount求和:
SELECT
user_id,
SUM(DISTINCT order_amount) AS distinct_product_total_amount
FROM user_order
GROUP BY user_id;
这里需要注意,如果同一用户同一商品有多条订单,且order_amount相同,DISTINCT order_amount会去重后求和,若金额不同则不会去重,实际使用时需要结合业务场景判断是否符合需求。
使用注意事项
- DISTINCT关键字只能用在SELECT语句中,不能用于WHERE、GROUP BY等子句。
- 聚合函数搭配DISTINCT时,会先对字段值去重再计算,效率会比不去重略低,数据量较大时需要评估性能。
- 如果同时使用GROUP BY和DISTINCT,GROUP BY的分组优先级高于DISTINCT,会先执行分组操作再执行去重。
- COUNT(DISTINCT 字段)统计时,会自动忽略字段值为NULL的记录,若需要统计NULL值需要额外处理。
总结
MySQL中实现不完全分组统计,核心就是灵活搭配DISTINCT关键字和聚合函数,根据业务需求选择是对查询字段组合去重,还是对聚合函数的入参字段去重。掌握这种用法可以应对大部分不需要完整分组的统计场景,减少不必要的GROUP BY分组操作,让查询逻辑更简洁清晰。