SQL 字符串函数如何去掉重复字符?

来源:菜鸟站长作者:长沙网站建设头衔:草根站长
导读:本期聚焦于小伙伴创作的《SQL 字符串函数如何去掉重复字符?》,敬请观看详情,探索知识的价值。以下视频、文章将为您系统阐述其核心内容与价值。如果您觉得《SQL 字符串函数如何去掉重复字符?》有用,将其分享出去将是对创作者最好的鼓励。

在SQL的实际使用中,处理字符串里的重复字符是常见需求,比如用户填写的地址里重复了多个相同的区号,或者商品名称里出现了重复的修饰词,这些都需要通过字符串函数完成去重操作。不同数据库的内置函数存在差异,对应的实现方式也有所不同。

SQL 字符串函数如何去掉重复字符?

通用思路:利用替换函数逐次去重

大部分数据库都提供了REPLACE字符串函数,它的作用是把字符串中指定的子串替换成新的内容。我们可以基于这个函数,遍历字符串里的每个字符,把重复出现的字符替换成空串,从而实现去重。核心逻辑是先拆分字符串得到所有单个字符,再判断每个字符是否已经在结果字符串里存在,不存在就拼接,存在就跳过。

MySQL场景下的实现

MySQL没有内置的字符串拆分函数可以直接把字符串拆成单个字符的集合,但是可以通过自定义变量配合循环来实现。下面的示例会处理test_str表里的content字段,去掉其中的重复字符。

-- 创建测试表
CREATE TABLE test_str (
    id INT PRIMARY KEY AUTO_INCREMENT,
    content VARCHAR(100)
);

-- 插入测试数据
INSERT INTO test_str (content) VALUES ('aabbccddeeff'), ('1122334455'), ('hello_world_hello');

-- 去掉重复字符的存储过程
DELIMITER //
CREATE PROCEDURE remove_duplicate_char()
BEGIN
    DECLARE v_id INT;
    DECLARE v_content VARCHAR(100);
    DECLARE v_result VARCHAR(100) DEFAULT '';
    DECLARE v_len INT;
    DECLARE v_i INT DEFAULT 1;
    DECLARE v_char CHAR(1);
    DECLARE done INT DEFAULT 0;
    -- 定义游标遍历所有记录
    DECLARE cur CURSOR FOR SELECT id, content FROM test_str;
    DECLARE CONTINUE HANDLER FOR NOT FOUND SET done = 1;
    
    OPEN cur;
    read_loop: LOOP
        FETCH cur INTO v_id, v_content;
        IF done THEN
            LEAVE read_loop;
        END IF;
        -- 重置结果和循环变量
        SET v_result = '';
        SET v_i = 1;
        SET v_len = CHAR_LENGTH(v_content);
        -- 遍历每个字符
        WHILE v_i <= v_len DO
            SET v_char = SUBSTRING(v_content, v_i, 1);
            -- 判断字符是否已经在结果里
            IF INSTR(v_result, v_char) = 0 THEN
                SET v_result = CONCAT(v_result, v_char);
            END IF;
            SET v_i = v_i + 1;
        END WHILE;
        -- 更新去重后的结果
        UPDATE test_str SET content = v_result WHERE id = v_id;
    END LOOP;
    CLOSE cur;
END //
DELIMITER ;

-- 调用存储过程
CALL remove_duplicate_char();

-- 查看结果
SELECT * FROM test_str;

SQL Server场景下的实现

SQL Server可以通过自定义函数结合循环逻辑实现字符串去重,下面的示例创建了一个自定义函数fn_remove_duplicate,接收字符串参数返回去重后的结果。

-- 创建测试表
CREATE TABLE test_str (
    id INT IDENTITY(1,1) PRIMARY KEY,
    content NVARCHAR(100)
);

-- 插入测试数据
INSERT INTO test_str (content) VALUES ('aabbccddeeff'), ('1122334455'), ('hello_world_hello');

-- 创建去重函数
CREATE FUNCTION fn_remove_duplicate (@str NVARCHAR(100))
RETURNS NVARCHAR(100)
AS
BEGIN
    DECLARE @result NVARCHAR(100) = '';
    DECLARE @len INT = LEN(@str);
    DECLARE @i INT = 1;
    DECLARE @char NCHAR(1);
    WHILE @i <= @len
    BEGIN
        SET @char = SUBSTRING(@str, @i, 1);
        -- 判断字符是否已在结果中
        IF CHARINDEX(@char, @result) = 0
        BEGIN
            SET @result = @result + @char;
        END
        SET @i = @i + 1;
    END
    RETURN @result;
END;

-- 查询去重后的结果
SELECT id, dbo.fn_remove_duplicate(content) AS new_content FROM test_str;

注意事项

  • 上述方法会保留字符第一次出现的位置,后续重复的字符会被移除,如果需要保留最后一次出现的字符,可以调整判断逻辑,从字符串末尾开始遍历。
  • 如果字符串中包含中文、特殊符号等多字节字符,需要确保使用的字符串函数支持多字节处理,比如MySQL里用CHAR_LENGTH代替LENGTH计算字符数,避免拆分错误。
  • 对于超长字符串,循环遍历的性能会有所下降,如果处理的数据量较大,可以评估是否需要优化逻辑,比如先拆分字符到临时表再做去重聚合。

SQL字符串函数去掉重复字符REPLACE修改时间:2026-07-22 02:54:23

免责声明:​ 已尽一切努力确保本网站所含信息的准确性。网站内容多为原创整理与精心编撰,观点力求客观中立。本站旨在免费分享,内容仅供个人学习、研究或参考使用。若引用了第三方作品,版权归原作者所有。如内容涉及您的权益,请联系我们处理。
内容垂直聚焦
专注技术核心技术栏目,确保每篇文章深度聚焦于实用技能。从代码技巧到架构设计,为用户提供无干扰的纯技术知识沉淀,精准满足专业提升需求。
知识结构清晰
覆盖从开发到部署的全链路。AI、前端、编程、数据库、服务器、建站、系统层层递进,构建清晰学习路径,帮助用户系统化掌握开发与运维所需的核心技术。
深度技术解析
拒绝泛泛而谈,深入技术细节与实践难点。无论是数据库优化还是服务器配置,均结合真实场景与代码示例进行剖析,致力于提供可直接应用于工作的解决方案。
专业领域覆盖
精准对应开发生命周期。从前端界面到后端编程,从数据库操作到服务器运维,形成完整闭环,一站式满足全栈工程师和运维人员的技术需求。
即学即用高效
内容强调实操性,步骤清晰、代码完整。用户可根据教程直接复现和应用于自身项目,显著缩短从学习到实践的距离,快速解决开发中的具体问题。
持续更新保障
专注既定技术方向进行长期、稳定的内容输出。确保各栏目技术文章持续更新迭代,紧跟主流技术发展趋势,为用户提供经久不衰的学习价值。