先讲一个核心判断:在SQL Server里做行转列合并,STRING_AGG 确实是目前最优雅的方案,但前提是版本得够。

STRING_AGG 在 SQL Server 2017+ 才可用
如果环境是 SQL Server 2016 或更早,直接写 STRING_AGG 会报错:‘STRING_AGG’ is not a recognized built-in function name。这个函数从 SQL Server 2017(14.x)才开始引入,Azure SQL Database 和 Azure SQL Managed Instance 也一并支持。最直接的确认方式是跑一句 SELECT @@VERSION。低于 2017 的环境,乖乖用 FOR XML PATH('') 或者 CLR 自定义聚合——没有“兼容模式”能帮你绕过这个限制。
基本用法:按组拼接字符串,必须配合 GROUP BY
STRING_AGG 是一个聚合函数,不能单独用在无分组的 SELECT 中,否则会报错:Column 'xxx' is invalid in the select list because it is not contained in either an aggregate function or the GROUP BY clause。典型的场景就是:把同一组的多行值合并成一个逗号分隔的字符串。
比方说,把每个部门下的员工姓名拼成一行:
SELECT dept, STRING_AGG(emp_name, ', ') AS namesFROM employeesGROUP BY dept;
这里有两点需要注意:
• 第二个参数是分隔符,它必须是常量表达式,不能是列名或变量;
• 默认情况下拼接顺序是不保证的,如果需要固定顺序,必须显式加上 WITHIN GROUP (ORDER BY emp_name)。
排序和去重必须手动处理,STRING_AGG 本身不支持
STRING_AGG 没有提供内置的去重或自动排序功能。如果原始数据里存在重复值,或者需要按特定字段排序,那就得提前动手:
- 去重:用子查询或 CTE 先做
DISTINCT或GROUP BY去重,然后再聚合 - 排序:必须写
WITHIN GROUP (ORDER BY ...),而且只能使用确定性的列,不能是那些未命名的表达式结果
错误写法像这样:STRING_AGG(DISTINCT emp_name, ', ') —— 直接语法错误。
正确写法是这样:
SELECT dept, STRING_AGG(emp_name, ', ') WITHIN GROUP (ORDER BY emp_name)FROM (SELECT DISTINCT dept, emp_name FROM employees) tGROUP BY dept;
NULL 值默认被忽略,但空字符串会参与拼接
STRING_AGG 遇到 NULL 值会直接跳过,不会生成额外的分隔符。这一点和 CONCAT 不同,通常来说符合预期。但要注意的是:''(空字符串)会被当成有效值拼进去,可能导致出现多余逗号,比如 'Alice,,Charlie' 这种情况。
安全做法是预处理:用 NULLIF(emp_name, '') 或 CASE WHEN emp_name != '' THEN emp_name END,然后再进入聚合。如果想把 NULL 显示为占位符,比如 '(unknown)',那就要用 ISNULL(emp_name, '(unknown)') 转换后再聚合。
拼接结果的长度上限是 varchar(max)(2GB),但实际运行中会受内存和查询超时的限制;如果数据量太大,建议加 TOP N 或做分页控制。
