① find 方法入门
在 MongoDB 中,执行查询操作的核心方法就是 find。它返回的结果是一个文档子集,可能为空,也可能包含整个集合。第一个参数至关重要:一个文档对象,用于设定查询条件。如果传入空文档 {},则返回集合中的所有文档;若不传任何参数,默认行为也是返回全部文档。
# 语法:db.stu.find({查询条件})
先看一个最简单的示例,不指定任何条件:

再来看带条件的查询:
② 指定返回的键(注意:_id 默认被返回,即使不指定)
有时我们并不需要整个文档的全部字段,只关心其中几个。此时 find 的第二个参数就派上了用场——用来指定你想返回哪些键。这样做的好处非常直接:既减少了网络传输的数据量,又节省了客户端解码文档所需的时间和内存开销。
# 语法:db.stu.find({查询条件}, {指定要返回哪些键})
例如,查询 name 为 paul 的文档,只返回 age 和 hobby 字段:

再比如,查询 name 为 paul 的文档,但排除 like 字段:

从以上两个示例可以看出,find 的第二个参数既能指定仅返回哪些字段,也能指定排除哪些字段,使用起来十分灵活。
③ 查询条件(范围查询、或查询、取反操作)
查询当然不止于前面的精确匹配,还能处理更复杂的场景,比如范围、OR 逻辑、取反等。下面逐一介绍。
(1)比较操作符:$gt、$gte、$lt、$lte、$ne,分别对应大于、大于等于、小于、小于等于、不等于。当然也可以组合使用。
查询 _id 大于 2 且小于 5 的文档:

查询 _id 不等于 3 的文档:

(2)MongoDB 提供了两种 OR 查询方式。$in 用于查询同一个键的多个值,而 $or 更通用,可以在多个键中查询任意给定值。
用 $in 查询 name 为 paul 或 wang 的文档:

用 $nin 查询 name 既不是 paul 也不是 wang 的文档(与 $in 相反,相当于取反):

注意:$in 非常灵活,可以指定不同的条件和值。例如,如果一个文档的 _id 可能是数字 1 也可能是字符串 "paul",那么可以用下面的方式查询:
查询 _id 为 1 或为 "paul" 的文档:

前面介绍了两种 OR 方式,现在来看 $or。它和 $in 一样都接受一个数组,但 $or 接受的是多个条件文档。
查询 name 为 wang 或者 score 为 90 的文档:

(3)取反操作靠 $not,它是一个元条件句,可以用于任何其他条件之上。
查询 name 既不是 wang 也不是 zhou 的文档:

④ 特定类型查询(null 值如何查询)
null 值在 MongoDB 查询中有点特殊:它不仅会返回某个键值为 null 的文档,还会返回那些根本不存在该键的文档。看一个例子,查询 age 为 null 的文档:

结果会包含所有满足条件的文档,也会包含没有 age 键的文档——这通常不是我们想要的。那么如何只查询 age 确实为 null 的文档呢?需要同时检查键是否存在,并且值为 null。可以用 $in 搭配 null 和 $exists:

上面的写法可能有点绕,也可以直接用 $eq 来实现:

⑤ 查询数组
(1)查询数组元素与查询普通标量值的方式是一样的。例如,查询 hobby 数组中包含 "game" 的文档:

(2)如果想通过多个元素来匹配数组,可以用 $all。例如,查询 hobby 数组中同时包含 "meat" 和 "fruit" 的文档:

(3)查询数组特定位置的元素——下标从 0 开始。例如,查询 hobby 数组第 1 个元素为 "fruit" 的文档:

(4)查询数组长度,例如查询 hobby 数组长度为 3 的文档:

⑥ 查询内嵌文档(使用点语法)
查询内嵌文档时,用点号语法来访问子字段。例如,查询 msg 中 addr 值为 "456" 的文档:

⑦ 限制返回结果(limit)
限制返回条数用 limit。例如,查询所有结果只返回前三个:

⑧ 跳过指定数量(skip)
跳过指定数量的文档用 skip。例如,查询所有文档并跳过前三个:

注意:如果跳过的数据量过大,会影响性能。怎么解决呢?一种常见做法是:以某个键排序,先查询第一页的数据;后续查询时,用第一页最后一个文档的排序键值作为条件,再继续查询下一页。这样就能避免使用 skip 带来的性能问题。
⑨ 指定键排序(可以指定多个键)
排序用 sort,可以指定多个键。正序用 1,倒序用 -1。例如,查询所有文档,并按 name 值正序排列:

注意:当某个键的值有多种类型时,排序顺序是预先定义好的:最小值 < null < 数字 < 字符串 < 对象/文档 < 数组 < 二进制数据 < 对象ID < 布尔值 < 日期型 < 时间戳 < 正则表达式 < 最大值。这个顺序在需要混合类型排序时非常有用。
