在Web开发中,使用JS实现关键字过滤是保护社区内容安全的常见需求。我们可以通过准备敏感词列表,然后利用字符串或正则手段对用户输入进行检测和替换,从而屏蔽不当内容。

一、基础字符串替换方案
最简单的方式是将敏感词放在数组中,遍历并用星号替换。这种方法易于理解,适合词量较少的场景。
// 敏感词列表
var badWords = ['广告', '暴力', '赌博'];
// 过滤函数
function filterText(text) {
badWords.forEach(function(word) {
// 全局替换敏感词为星号
var reg = new RegExp(word, 'g');
text = text.replace(reg, '*'.repeat(word.length));
});
return text;
}
var userInput = '不要在这里发广告和赌博信息';
console.log(filterText(userInput)); // 不要在这里发**和**信息
二、使用正则一次性过滤
如果敏感词较多,反复创建正则效率较低。我们可以拼接为一个正则,一次性替换。
var badWords = ['广告', '暴力', '赌博', '诈骗'];
// 拼接正则,注意特殊字符转义
function escapeReg(str) {
return str.replace(/[.*+?^${}()|[]\]/g, '\$&');
}
var reg = new RegExp(badWords.map(escapeReg).join('|'), 'g');
function filterByReg(text) {
return text.replace(reg, function(match) {
return '*'.repeat(match.length);
});
}
console.log(filterByReg('严禁暴力诈骗')); // 严禁****
三、利用字典树优化
当词库达到上千条时,上述方法会有性能问题。可以使用字典树(Trie)结构减少扫描次数。
// 简单Trie节点
function TrieNode() {
this.children = {};
this.isEnd = false;
}
var root = new TrieNode();
function insert(word) {
var node = root;
for (var ch of word) {
if (!node.children[ch]) node.children[ch] = new TrieNode();
node = node.children[ch];
}
node.isEnd = true;
}
['广告', '暴力'].forEach(insert);
// 扫描文本(简化版)
function filterWithTrie(text) {
var result = '';
for (var i = 0; i < text.length; i++) {
var node = root;
var j = i;
var matchLen = 0;
while (j < text.length && node.children[text[j]]) {
node = node.children[text[j]];
if (node.isEnd) matchLen = j - i + 1;
j++;
}
if (matchLen > 0) {
result += '*'.repeat(matchLen);
i += matchLen - 1;
} else {
result += text[i];
}
}
return result;
}
console.log(filterWithTrie('发广告违法')); // 发**违法
四、注意事项
- 前端过滤可被用户绕过,重要场景必须配合后端过滤。
- 使用<code>标签说明代码术语时,内部如<input>需转义,但函数调用如replace()不是标签。
- 敏感词可能包含特殊正则字符,拼接前务必转义。
关键字过滤只是第一道防线,不能替代服务端的内容安全策略。
五、小结
通过JS实现关键字过滤,开发者可以根据项目规模选择字符串替换、正则合并或字典树方案。对于学习用途和轻量表单,前两种已足够;大型应用建议结合专业词库与后端接口,保障系统稳定与合规。