Не используйте регулярные выражения для анализа HTML. [X] [HT] ML не является обычным языком и не может быть надежно обработан с помощью регулярных выражений. Ваш браузер имеет хороший встроенный анализатор HTML; позвольте этому взять на себя нагрузку при работе с тегами.
Также вы не хотите работать над html()/innerHTML
над телом. Это приведет к сериализации и повторному анализу всей страницы, что будет медленным и приведет к потере любой информации, которую нельзя сериализовать в HTML, такой как обработчики событий, значения форм и другие ссылки JavaScript.
Вот метод, использующий DOM, который мне подходит:
function replaceInElement(element, find, replace) {
// iterate over child nodes in reverse, as replacement may increase
// length of child node list.
for (var i= element.childNodes.length; i-->0;) {
var child= element.childNodes[i];
if (child.nodeType==1) { // ELEMENT_NODE
var tag= child.nodeName.toLowerCase();
if (tag!='style' && tag!='script') // special case, don't touch CDATA elements
replaceInElement(child, find, replace);
} else if (child.nodeType==3) { // TEXT_NODE
replaceInText(child, find, replace);
}
}
}
function replaceInText(text, find, replace) {
var match;
var matches= [];
while (match= find.exec(text.data))
matches.push(match);
for (var i= matches.length; i-->0;) {
match= matches[i];
text.splitText(match.index);
text.nextSibling.splitText(match[0].length);
text.parentNode.replaceChild(replace(match), text.nextSibling);
}
}
// keywords to match. This *must* be a 'g'lobal regexp or it'll fail bad
var find= /\b(keyword|whatever)\b/gi;
// replace matched strings with wiki links
replaceInElement(document.body, find, function(match) {
var link= document.createElement('a');
link.href= 'http://en.wikipedia.org/wiki/'+match[0];
link.appendChild(document.createTextNode(match[0]));
return link;
});