今天我们来深入探讨 MySQL 中的 FIND_IN_SET 函数,这是一个非常实用的字符串处理工具,专门用于在逗号分隔的字符串列表中查找指定值的位置。别看它看似简单,掌握好这个函数能让数据库查询工作事半功倍。

一、函数语法详解
FIND_IN_SET(str, strlist)
| 参数 | 说明 |
|---|---|
| str | 要查找的字符串 |
| strlist | 逗号分隔的字符串列表(如 'A,B,C') |
返回值逻辑非常清晰:如果找到则返回位置编号(从 1 开始计数),未找到则返回 0;若 str 或 strlist 为 NULL,结果同样为 NULL。需要特别注意的是,空字符串 '' 也被视为未找到,返回 0。
二、基本使用示例
SELECT FIND_IN_SET('B', 'A,B,C,D'); -- 返回 2
SELECT FIND_IN_SET('Z', 'A,B,C,D'); -- 返回 0
SELECT FIND_IN_SET(NULL, 'A,B,C,D'); -- 返回 NULL
SELECT FIND_IN_SET('B', NULL); -- 返回 NULL
SELECT FIND_IN_SET('B', ''); -- 返回 0
三、常见应用场景
1. 判断某个值是否存在于逗号分隔字符串中
这是最典型的用法,直接利用 FIND_IN_SET(...) > 0 作为条件,例如查询所属系统包含 '1' 的所有记录:
SELECT * FROM vehicle WHERE FIND_IN_SET('1', belonging_system) > 0;
2. 按逗号分隔字符串自定义排序
当需要使结果集按照特定顺序展示时,比如按用户指定的 ID 顺序(3,1,2)排序,FIND_IN_SET 可以轻松实现:
SELECT * FROM user ORDER BY FIND_IN_SET(id, '3,1,2');
3. 结合 COALESCE 处理 NULL 值
如果参数可能为 NULL,并且希望在 NULL 时返回全部数据,否则只返回匹配记录,可以这样编写:
SELECT * FROM vehicle WHERE (?1 IS NULL OR FIND_IN_SET(?1, belonging_system) > 0);
4. 统计某个值出现的次数
想知道 VIN 码中包含 'L58' 的车辆有多少?直接使用 COUNT 配合条件即可:
SELECT COUNT(*) FROM vehicle WHERE FIND_IN_SET('L58', vin) > 0;
四、在你的业务场景中运用 FIND_IN_SET
场景:belonging_system 字段存储逗号分隔字符串
假设你的数据表中 belonging_system 字段存放的是类似 '1,2,3' 这样的字符串,需要查询包含某个特定 systemId 的记录:
-- 查询 belonging_system 包含 systemId 的所有记录
SELECT * FROM vehicle WHERE FIND_IN_SET('1', belonging_system) > 0;
-- 结合参数判空
SELECT * FROM vehicle WHERE (?1 IS NULL OR FIND_IN_SET(?1, belonging_system) > 0);
JPA 原生查询写法
如果项目使用 JPA 框架,写原生查询也非常直接:
@Query(value = "SELECT * FROM vehicle v " +
"WHERE (COALESCE(?1, NULL) IS NULL OR FIND_IN_SET(?1, v.belonging_system) > 0)",
nativeQuery = true)
Page findBySystemId(@Param("systemId") String systemId, Pageable pageable);
五、FIND_IN_SET 与 IN 的对比
很多初学者容易混淆 FIND_IN_SET 和 IN,实际上它们各有明确的适用场景。下面这张对比表可以让差异一目了然:
| 对比项 | FIND_IN_SET | IN |
|---|---|---|
| 适用场景 | 字段是逗号分隔的字符串 | 字段是单个值 |
| 用法 | FIND_IN_SET('A', column) > 0 | column IN ('A', 'B') |
| 索引使用 | ❌ 无法使用索引 | ✅ 可以使用索引 |
| 性能 | 全表扫描,数据量大时慢 | 有索引时快 |
| 参数传递 | 传单个字符串 | 需要传多个值(集合) |
核心区别一句话总结:IN 用于匹配多个值的列表,而 FIND_IN_SET 专门用于匹配单个字段中存储的逗号分隔字符串。两者不要搞混。
六、性能注意事项
⚠️ 这里必须重点提醒:FIND_IN_SET 无法利用索引,当数据量增大时性能会急剧下降。具体参考以下经验数据:
| 数据量 | 性能表现 |
|---|---|
| < 1 万条 | ✅ 可以接受 |
| 1 万 ~ 10 万 | ⚠️ 可能变慢 |
| > 10 万 | ❌ 严重性能问题 |
优化建议
改用关联表(推荐)
- 将
belonging_system从逗号分隔字符串改为多对多关联表,然后使用IN或EXISTS查询,索引就能发挥作用。
- 将
使用 JSON 数组(MySQL 5.7+)
-- 存储为 JSON 数组 SELECT * FROM vehicle WHERE JSON_CONTAINS(belonging_system, '"1"');
使用全文索引
ALTER TABLE vehicle ADD FULLTEXT(belonging_system); SELECT * FROM vehicle WHERE MATCH(belonging_system) AGAINST('1');
七、完整示例汇总
最后提供几个常见的完整用法,方便你直接复制参考:
-- 1. 基本查找
SELECT FIND_IN_SET('2', '1,2,3,4'); -- 返回 2
-- 2. 在 WHERE 中使用
SELECT * FROM user WHERE FIND_IN_SET('admin', roles) > 0;
-- 3. 结合 ORDER BY(按指定顺序)
SELECT * FROM product WHERE id IN (3,1,2) ORDER BY FIND_IN_SET(id, '3,1,2');
-- 4. 结合 CASE
SELECT
name,
CASE
WHEN FIND_IN_SET('admin', roles) > 0 THEN '管理员'
WHEN FIND_IN_SET('user', roles) > 0 THEN '普通用户'
ELSE '未知'
END AS role_name
FROM user;
八、总结
| 要点 | 说明 |
|---|---|
| 功能 | 在逗号分隔的字符串中查找值的位置 |
| 返回值 | 找到返回位置(1-based),没找到返回 0 |
| 主要场景 | 判断值是否存在于逗号分隔字段中 |
| 优点 | 简单直观,适合小数据量 |
| 缺点 | 无法使用索引,大数据量时性能差 |
| 替代方案 | 关联表、JSON 数组、全文索引 |
建议:如果 belonging_system 字段经常被查询,最好改为多对多关联表,彻底解决性能瓶颈。如果数据量较小(< 1 万),FIND_IN_SET 使用起来仍然非常顺手,不必过度设计。
