MySQL的全文搜索功能是针对文本类型字段设计的高效检索方案,相比传统的LIKE '%关键词%'查询,它依托全文索引可以大幅降低查询耗时,同时支持容错匹配,能够应对用户输入存在拼写偏差、词形变化等场景,适合用在文章搜索、商品描述检索等业务中。

全文搜索的基础配置
要使用MySQL的全文搜索,首先需要对目标字段创建全文索引,目前MySQL的InnoDB和MyISAM引擎都支持全文索引,推荐使用InnoDB引擎。创建全文索引的语法如下:
-- 创建表时添加全文索引
CREATE TABLE article (
id INT PRIMARY KEY AUTO_INCREMENT,
title VARCHAR(200) NOT NULL,
content TEXT NOT NULL,
-- 对title和content字段创建联合全文索引
FULLTEXT INDEX ft_idx_title_content (title, content)
) ENGINE=InnoDB DEFAULT CHARSET=utf8mb4;
-- 已有表添加全文索引
ALTER TABLE article ADD FULLTEXT INDEX ft_idx_title_content (title, content);
需要注意,全文索引只支持CHAR、VARCHAR、TEXT类型的字段,且默认最小分词长度为4个字符,低于该长度的词汇不会被纳入索引,可通过调整ft_min_word_len参数修改该配置,修改后需要重建全文索引才会生效。
实现基础模糊匹配
MySQL全文搜索默认使用自然语言模式,会计算关键词和文本的相关性得分,返回匹配度高的结果,基础查询语法如下:
-- 自然语言模式查询,匹配title或content中包含MySQL和全文搜索的记录
SELECT
id,
title,
content,
-- 相关性得分,值越高匹配度越高
MATCH(title, content) AGAINST('MySQL 全文搜索' IN NATURAL LANGUAGE MODE) AS score
FROM article
WHERE MATCH(title, content) AGAINST('MySQL 全文搜索' IN NATURAL LANGUAGE MODE)
ORDER BY score DESC;
如果需要更灵活的匹配规则,可以使用布尔模式,通过操作符控制匹配逻辑,比如+表示必须包含,-表示必须不包含,*表示通配符匹配:
-- 布尔模式查询:必须包含MySQL,包含全文的优先级更高,不包含检索的记录被排除
SELECT id, title, content
FROM article
WHERE MATCH(title, content) AGAINST('+MySQL 全文* -检索' IN BOOLEAN MODE);
实现容错检索
全文搜索的容错能力主要通过以下两种方式实现:
1. 分词与词形适配
MySQL的全文索引会对文本进行分词,默认的分词规则会处理常见的词形变化,比如英文的复数、时态变化,中文场景下如果需要更好的分词效果,可以配置ngram全文解析器,适配中文的分词需求:
-- 创建支持中文分词的ngram全文索引,ngram_token_size设置为2,即按2字词组分词
CREATE TABLE article_cn (
id INT PRIMARY KEY AUTO_INCREMENT,
title VARCHAR(200) NOT NULL,
content TEXT NOT NULL,
FULLTEXT INDEX ft_idx_cn (title, content) WITH PARSER ngram
) ENGINE=InnoDB DEFAULT CHARSET=utf8mb4;
-- 查询包含MySQL和模糊匹配相关的内容,ngram会自动匹配相邻词组
SELECT id, title, content
FROM article_cn
WHERE MATCH(title, content) AGAINST('MySQL 模糊匹配' IN NATURAL LANGUAGE MODE);
2. 容错参数调整
可以通过调整全文搜索的相关参数提升容错性,比如放宽最小分词长度,让短关键词也能被匹配,或者调整相关性得分阈值,让匹配度稍低的结果也能被返回:
-- 查看当前全文搜索相关参数
SHOW VARIABLES LIKE 'ft_%';
-- 临时调整最小分词长度为2,仅当前会话生效
SET SESSION ft_min_word_len = 2;
-- 查询时设置相关性得分阈值,返回得分大于0.1的记录
SELECT
id,
title,
content,
MATCH(title, content) AGAINST('MySQL 全文' IN NATURAL LANGUAGE MODE) AS score
FROM article
WHERE MATCH(title, content) AGAINST('MySQL 全文' IN NATURAL LANGUAGE MODE) > 0.1;
注意事项
- 全文索引会占用额外的存储空间,需要根据实际业务需求选择需要建立索引的字段,避免不必要的资源消耗。
- 布尔模式下的通配符
*只能放在关键词末尾,不能放在开头,比如全文*是合法的,*全文无法生效。 - 如果表的数据量较小,全文搜索的效果可能不如LIKE查询,因为全文索引的维护成本和查询优化在大数据量下优势更明显。
- 修改全文搜索相关全局参数后,需要执行
REPAIR TABLE 表名 QUICK;重建全文索引,配置才会生效。
总结
MySQL的全文搜索功能可以有效替代传统的LIKE模糊查询,提升文本检索的性能,同时通过布尔模式、ngram解析器、参数调整等方式可以实现不同场景下的容错检索需求。在实际使用中,需要根据业务的数据量、文本类型、查询需求选择合适的索引配置和查询模式,平衡查询效率和匹配准确性。