You need to enable JavaScript to run this app.
优惠活动
大模型
产品
解决方案
定价
更多

MongoDB Java中使用$in查询时如何获取去重记录

解决MongoDB多ID查询时获取每个ID唯一记录的方案

嘿,这个需求我之前也碰到过,用MongoDB的聚合框架就能完美搞定,给你捋两个靠谱的方案:

方案一:聚合管道($match + $group + 可选排序)

这是最通用的方法,先筛选目标ID的记录,再按ID分组取唯一记录,还能自定义取哪一条(比如最早/最新的)。

基础版(取每组第一条记录)

db.your_collection_name.aggregate([
  // 第一步:筛选出你要查询的ID集合,注意如果是ObjectID要转成ObjectId类型
  { $match: { _id: { $in: [ObjectId("60d21b4667d0d8992e610c85"), ObjectId("60d21b8967d0d8992e610c86")] } } },
  // 第二步:按_id分组,用$first取每组的第一条记录($$ROOT代表整条文档)
  { $group: {
      _id: "$_id",
      unique_doc: { $first: "$$ROOT" }
    }
  },
  // 可选:把嵌套的unique_doc展开,让结果和普通find返回的结构一致
  { $replaceRoot: { newRoot: "$unique_doc" } }
])

进阶版(取每组最新的记录)

如果想按某个字段(比如updateTime)排序,取每组最新的记录,只需要在$match之后加一个$sort阶段:

db.your_collection_name.aggregate([
  { $match: { _id: { $in: [ObjectId("id1"), ObjectId("id2")] } } },
  // 先按updateTime倒序,这样最新的记录排在前面
  { $sort: { updateTime: -1 } },
  { $group: {
      _id: "$_id",
      unique_doc: { $first: "$$ROOT" }
    }
  },
  { $replaceRoot: { newRoot: "$unique_doc" } }
])

方案二:使用$addToSet(适合只需要特定字段的场景)

如果你只需要每个ID对应的几个特定字段,也可以用$addToSet直接聚合唯一值:

db.your_collection_name.aggregate([
  { $match: { _id: { $in: [ObjectId("id1"), ObjectId("id2")] } } },
  { $group: {
      _id: "$_id",
      // 把需要的字段用$addToSet收集唯一值,这里假设name是唯一的
      name: { $addToSet: "$name" },
      createTime: { $addToSet: "$createTime" }
    }
  },
  // 可选:把数组转成单个值(因为每个ID只有唯一记录,数组里只有一个元素)
  { $project: {
      name: { $arrayElemAt: ["$name", 0] },
      createTime: { $arrayElemAt: ["$createTime", 0] }
    }
  }
])

注意事项

  • 如果你的ID是字符串类型,不需要用ObjectId()包裹,直接写字符串数组就行;如果是MongoDB原生的ObjectID,必须用ObjectId()转换,否则查不到数据。
  • $first和$last是按照文档在集合中的存储顺序取的,如果你有明确的排序需求,一定要先加$sort阶段。

内容的提问来源于stack exchange,提问作者Pratik

相关产品推荐
方舟 Agent Plan

超全模态模型 × Harness 升级,最新支持 Deepseek-V4.1-Flash、GLM-5.3 系列、Doubao-Seedream-5.0-pro、Kimi-K3 (部分), 限时 9.9 元起

最近更新时间:2026.05.21 06:58:08