导读:本期聚焦于仓本创作的《MongoDB聚合管道中如何使用$bottomN取分组内排名后N条记录?》,敬请观看详情。假设需要按分类统计销售额最低的3个商品,如果先排序再分组,很容易丢失组内边界,代码也越写越长。MongoDB 5.2 推出的 $bottomN 累加器正是解决这一类问题的工具。它可以在 $group 阶段中直接按指定字段排序,并返回每组最后 N 个元素,既能取原始文档,也能只输出部分字段。本文会结合商品销售数据,拆解 $bottomN 的 n、sortBy、output 三个核心参数,说明升序和降序对底部结果的实际影响,并演示如何在 $group 中一次性拿到分组后 N 条记录。随后还会对比 $bottomN 与 $sort 加 $limit、$lastN 的差异,帮你判断在数据量较大或排序字段有重复值时该选哪种方案。阅读完可以清楚知道 $bottomN 适合哪些统计场景,避免把顶部和底部方向写反。

MongoDB 聚合管道里经常会出现“按分组取排序后最后几条”的需求。比如统计每个商品分类中销售额最低的 3 个商品、每个班级中成绩垫底的 5 名学生,或者每个服务节点上响应时间最慢的几条日志。过去这类需求通常要组合 $sort、$group、$project 甚至 $unwind 才能完成,代码层级一多就容易把排序方向写反。MongoDB 5.2 引入的 $bottomN 累加器就是专门用来在分组内按指定顺序截取底部 N 条记录的表达式,它让这类查询可以写得更直接,也更不容易出错。

MongoDB聚合管道中如何使用$bottomN取分组内排名后N条记录?

一、$bottomN 的定位与典型场景

$bottomN 不是独立的聚合管道阶段,而是用于 $group 或 $setWindowFields 阶段的累加器表达式。它的作用是:先对组内文档执行排序,然后从排序结果的底部开始取 N 个元素返回。这里“底部”由 sortBy 的排序方向决定,而不是简单指插入顺序靠后的文档。

以一个销售集合为例,集合中每条文档记录一个商品的一次销售统计,包含 category、product、sales 三个字段。如果需求是找出每个分类中销售额最低的三个商品,传统写法需要先按分类和销售额排序,再用 $group 把商品压入数组,最后用 $project 截断数组。这种方式虽然能实现,但阶段比较多,而且一旦后续需求改为取前几条,排序方向要同步调整,比较繁琐。

$bottomN 把“排序”和“截取底部 N 条”压缩到一个表达式中。开发者只需要在 $group 里写明 n 值、排序字段以及输出内容,聚合引擎就会在分组内部完成剩余工作。对于需要“每组底部若干条记录”的报表,它减少了流水线阶段,也让意图更加清晰。

二、$bottomN 的核心语法与参数细节

$bottomN 的完整语法结构如下:

{
  $bottomN: {
    n: <number>,
    sortBy: { <field1>: <sort order> },
    output: <expression>
  }
}

其中 n 表示每组要返回的元素个数,必须是正整数。如果 n 超过组内文档数量,$bottomN 会把整组文档全部返回,不会报错。sortBy 是一个排序文档,语法与 $sort 阶段一致,1 表示升序,-1 表示降序。output 则控制每个元素的输出形式,可以写字段路径,也可以写文档表达式,还可以嵌入聚合表达式。

最容易出错的是 sortBy 的方向。假设业务目标是“取销售额最低的 3 个商品”,就应该写 sortBy: { sales: -1 }。因为 -1 表示按销售额降序排列,大值排在前面,小值落在底部,$bottomN 再从底部截取,自然拿到最低的 3 条。反过来如果写成升序,底部就是销售额最高的记录。

如果 sortBy 字段存在大量相同值,仅按该字段排序可能无法保证稳定返回,具体返回哪些底部记录可能随执行计划变化。为了让结果可预期,可以在 sortBy 中追加唯一字段作为次级排序条件,比如 sortBy: { sales: -1, _id: 1 }。这样即使销售额相同,也会按 _id 升序稳定决定顺序。

另外 output 不一定是单个字段。比如想同时返回商品名和销售额,可以写成 output: { product: "$product", sales: "$sales" }。这种方式比先取完整文档再在应用层裁剪更省网络传输。

三、实战:按分类取销售额最低的后 N 条记录

下面构造一个简单的销售数据集合:

db.sales.insertMany([
  { _id: 1, category: "手机", product: "手机A", sales: 120 },
  { _id: 2, category: "手机", product: "手机B", sales: 80 },
  { _id: 3, category: "手机", product: "手机C", sales: 95 },
  { _id: 4, category: "电脑", product: "电脑A", sales: 300 },
  { _id: 5, category: "电脑", product: "电脑B", sales: 150 },
  { _id: 6, category: "电脑", product: "电脑C", sales: 420 },
  { _id: 7, category: "手机", product: "手机D", sales: 60 }
])

执行下面的聚合查询,可以一次拿到每个分类销售额最低的 3 个商品:

db.sales.aggregate([
  {
    $group: {
      _id: "$category",
      lowestThree: {
        $bottomN: {
          n: 3,
          sortBy: { sales: -1 },
          output: { product: "$product", sales: "$sales" }
        }
      }
    }
  }
])

查询结果大致如下:手机分类返回手机D、手机B、手机C,销售额分别为 60、80、95;电脑分类只有 3 条记录,所以全部返回,顺序为电脑B、电脑A、电脑C。可以看到,虽然原始插入顺序不是按销售额排列的,$bottomN 仍然按照 sortBy 指定的规则重新排序并截取,这正是它和 $lastN 的关键差异。

如果只需要商品名称,可以把 output 简化为 "$product",返回结果会变成一个字符串数组。如果 n 值需要动态决定,也可以从文档字段或表达式传入,但实际项目中建议先确认分组内数据规模,避免过大的 n 导致返回数组膨胀。

四、$bottomN 与 $sort 加 $limit、$lastN 的选择

传统写法通常先 $sort 让数据全局有序,再 $group 和 $push 收集数组,最后用 $slice 截取前 N 条。下面是一个等价示例,按分类和销售额升序排序,这样组内最低的 3 条会排在最前面,再取数组前 3 个元素:

db.sales.aggregate([
  { $sort: { category: 1, sales: 1 } },
  {
    $group: {
      _id: "$category",
      products: { $push: "$$ROOT" }
    }
  },
  {
    $project: {
      lowestThree: { $slice: [ "$products", 3 ] }
    }
  }
])

这种写法可以得到相同结果,但阶段更长。它依赖 $sort 在 $group 之前完成排序,并且 $push 会保留输入顺序。若数据量很大,$push 会把每个分组的全部文档都组装成数组,然后再从内存里截断,而 $bottomN 只保留符合要求的 N 个元素,不需要把组内所有文档都塞进一个数组。因此从内存占用的角度看,$bottomN 通常更有优势。

再看 $lastN。$lastN 也是从分组中取后 N 个元素,但它不排序,只按文档的输入顺序截取。如果数据在写入时已经按业务需要的顺序排列,$lastN 足够;如果写入顺序和业务排序无关,就必须使用 $bottomN。简单理解:$lastN 关心文档进来的顺序,$bottomN 关心 sortBy 指定的排序顺序。

还有 $bottom,它可以理解为 $bottomN 的 n 等于 1 时的单元素版本。不过 $bottom 返回的是单个值或对象,而 $bottomN 返回数组。实际开发中如果需要一组底部记录,优先选择 $bottomN;如果只要最后一名,用 $bottom 会让结果更加简洁。

在 MongoDB 5.2 以下版本中,这些累加器不可用,只能继续使用多阶段 $sort 加 $group 加 $slice 的写法。升级版本后,可以先在查询侧用 $bottomN 简化复杂分组统计代码,再观察执行计划,判断是否需要为 sortBy 字段建立合适的索引。需要特别留意,$bottomN 虽然减少了流水线阶段,但组内排序依旧有成本,每组基数很大时要结合业务限制 n 的值,避免返回过多无用数据。

MongoDB$bottomN聚合管道修改时间:2026-10-03 22:16:56

免责声明:已尽一切努力确保本网站所含信息的准确性。网站作品多为原创整理与精心创作,观点力求客观中立。本站旨在免费分享,内容仅供个人学习、研究或参考使用。若引用了第三方作品,版权归原作者所有。如内容涉及您的权益,请联系我们进行处理Email:chomcom@qq.com。
引用或转载本作品时,请注明当前出处:https://www.ipipp.com/html/1003/65269.html,基于非商业用途的前提下,欢迎转载或二创本作品。
内容垂直聚焦
专注技术核心技术栏目,确保每篇文章深度聚焦于实用技能。从代码技巧到架构设计,为用户提供无干扰的纯技术知识沉淀,精准满足专业提升需求。
知识结构清晰
覆盖从开发到部署的全链路。AI、前端、编程、数据库、服务器、建站、系统层层递进,构建清晰学习路径,帮助用户系统化掌握开发与运维所需的核心技术。
深度技术解析
拒绝泛泛而谈,深入技术细节与实践难点。无论是数据库优化还是服务器配置,均结合真实场景与代码示例进行剖析,致力于提供可直接应用于工作的解决方案。
专业领域覆盖
精准对应开发生命周期。从前端界面到后端编程,从数据库操作到服务器运维,形成完整闭环,一站式满足全栈工程师和运维人员的技术需求。
即学即用高效
内容强调实操性,步骤清晰、代码完整。用户可根据教程直接复现和应用于自身项目,显著缩短从学习到实践的距离,快速解决开发中的具体问题。
持续更新保障
专注既定技术方向进行长期、稳定的内容输出。确保各栏目技术文章持续更新迭代,紧跟主流技术发展趋势,为用户提供经久不衰的学习价值。