在 SQL 多表查询中,当基准表需要连接一个一对多关系的表时,如果不加处理,基准表的每一行可能会因为匹配到多条子表记录而被重复输出。实现基准表无重复结果连接,核心思路是让连接后的结果在基准表主键上保持唯一。

为什么基准表会出现重复
假设有一张用户表 users 作为基准表,和订单表 orders 是一对多关系。直接做 inner join 或 left join 时,一个用户有多笔订单就会生成多行,导致 users 的信息重复出现。
-- 会产生重复用户行的写法 select u.id, u.name, o.order_no from users u left join orders o on u.id = o.user_id;
使用聚合函数配合左连接
如果只需要子表的某一项汇总值或最新一条,可以用聚合函数把子表压成一行。这样基准表自然不会重复。
select u.id, u.name, count(o.id) as order_cnt from users u left join orders o on u.id = o.user_id group by u.id, u.name;
使用子查询先去重再连接
当子表需要取最新一条记录时,可先通过子查询按基准表主键去重,再和基准表连接。
select u.id, u.name, t.latest_order_no
from users u
left join (
select user_id, max(order_no) as latest_order_no
from orders
group by user_id
) t on u.id = t.user_id;
使用 distinct on 实现单行连接
在 PostgreSQL 中,可以用 distinct on 让子表每个 user_id 只保留一行,再连接基准表。
select u.id, u.name, o.order_no
from users u
left join (
select distinct on (user_id) user_id, order_no
from orders
order by user_id, create_time desc
) o on u.id = o.user_id;
方法对比
| 方式 | 适用场景 | 数据库支持 |
|---|---|---|
| 聚合函数加 group by | 只需要统计或汇总值 | 所有主流数据库 |
| 子查询去重 | 取子表最新或指定一条 | 所有主流数据库 |
| distinct on | 取子表排序后首条 | PostgreSQL |
书写注意点
- 连接前先明确基准表与子表的关系是一对一还是一对多。
- group by 的字段要包含基准表用于展示的所有非聚合列。
- 子查询里的排序字段决定了保留哪一条子表记录。
通过上述方式,即可在 SQL 查询中稳定实现基准表无重复结果连接,保证输出行数与基准表一致。