在MySQL中,GROUP BY是一种将数据按照某一列或多列的值进行分组的查询方式。它能把值相同的行合并成一组,从而让我们对每组数据做聚合计算,比如计数、求和或取平均值。掌握它的用法是写统计类SQL的基础。

一、GROUP BY基础语法
最基本的用法是在SELECT语句中指定要分组的列,并使用聚合函数处理其他列。以下示例按照city列分组,统计每个城市的用户数:
-- 按照city列的值进行分组,统计每组的记录数 SELECT city, COUNT(*) AS user_count FROM users GROUP BY city;
在这个查询里,所有city值相同的行会被归为一组,COUNT(*)计算每组有多少行。
二、多列分组
如果需要按多个维度归类,可以写多个列名,列之间用逗号隔开。下面按城市和性别两个列分组:
-- 按照city和gender两列的值进行分组 SELECT city, gender, COUNT(*) AS cnt FROM users GROUP BY city, gender;
此时只有当city和gender都相同的行才会被分在同一组。
三、配合聚合函数使用
GROUP BY通常和聚合函数一起出现。常见聚合函数如下:
- COUNT():统计组内行数
- SUM():计算组内某列数值总和
- AVG():计算组内平均值
- MAX()/MIN():取组内最大或最小值
例如统计每个商品的销售总额:
-- 按product_id分组,求每组amount之和 SELECT product_id, SUM(amount) AS total_sales FROM orders GROUP BY product_id;
四、HAVING筛选分组结果
WHERE在分组前过滤行,而HAVING在分组后过滤组。想只保留用户数大于10的城市,可以这样写:
-- 分组后筛选组,仅保留user_count大于10的组 SELECT city, COUNT(*) AS user_count FROM users GROUP BY city HAVING user_count > 10;
注意HAVING中可以使用聚合函数,而WHERE不行。
五、常见注意事项
在MySQL的ONLY_FULL_GROUP_BY模式下,SELECT中出现的非聚合列必须全部写在GROUP BY后面,否则会报错。例如下面写法是不允许的:
-- 错误示例:name未出现在GROUP BY中且非聚合列 SELECT city, name, COUNT(*) FROM users GROUP BY city;
应改为只选聚合列或把name也加入分组。此外,GROUP BY默认按分组列排序,若需其他顺序可显式加ORDER BY。
六、执行顺序简表
| 子句 | 作用阶段 |
|---|---|
| WHERE | 分组前过滤行 |
| GROUP BY | 按列值分组 |
| 聚合函数 | 计算每组指标 |
| HAVING | 分组后过滤组 |
| ORDER BY | 最终结果排序 |
通过上述示例可以看出,利用MySQL的GROUP BY按照某列的值进行分组,核心就是明确分组列、选好聚合逻辑,并分清WHERE与HAVING的分工。熟练运用后能轻松应对大部分业务统计需求。