原创

mongodb聚合排序的一个巨坑

现象：

mongodb cpu动不动要100%，如下图

分析原因：

查看慢日志发现，很多条这样的查询，一直未执行行完成，占用大量的CPU

[
 {
 $match: {
 "tags.taskId": "64dae0a9deb52d2f9a1bd71e",
 grnty: "minute",
 "tags.type": "task",
 "tags.taskRecordId":
 "64e5c004133738231bc36906",
 },
 },
 {
 $sort: {
 _id: -1,
 },
 },
 {
 $limit: 5,
 },
 {
 $unwind: "$ss",
 },
 {
 $group: {
 _id: "$ss.vs.inputQps",
 qps: {
 $avg: "$ss.vs.inputQps",
 },
 },
 },
]

查看程序里面有一段聚合的代码

Criteria criteria = new Criteria();
tags.forEach((k,v)->{
    String format = String.format(TAG_FORMAT, k);
    criteria.and(format).is(v);
});
criteria.and(MeasurementEntity.FIELD_GRANULARITY).is(Granularity.GRANULARITY_MINUTE);
MatchOperation match = Aggregation.match(criteria);
SortOperation sort = Aggregation.sort(Sort.by(Sort.Direction.DESC, "_id"));
LimitOperation limit = Aggregation.limit(5);
UnwindOperation unwind = Aggregation.unwind("ss", false);
GroupOperation group = Aggregation.group().avg("ss.vs.inputQps").as("qps");
Aggregation aggregation = Aggregation.newAggregation(match, sort, limit, unwind, group);

看一下这个代码也没有多大问题，但是就是执行很慢很慢，于是我explain这条语句，发现是先执行全集合sort 然后再match的，理论上应该是先match，然后再执行针对查询的结果做sort的.

已经使用了 $match 和 $sort 操作来筛选和排序文档。仍然对整个集合进行了排序?

这可能是由于 MongoDB 的查询优化器在执行查询时做出的决策。在 MongoDB 中，查询优化器会尝试根据查询计划和索引来优化查询性能。在某些情况下，优化器可能会选择在 $match 操作之后对整个集合进行排序，而不仅仅是对 $match 操作筛选出的文档进行排序。这可能是因为优化器认为在整个集合上进行排序的成本更低，或者由于其他优化策略。如果你希望只对 $match 操作筛选出的文档进行排序，可以尝试使用索引来优化查询。确保你的查询条件和排序字段都有适当的索引，这样可以帮助优化器做出更好的决策，以便只对筛选结果进行排序。