又来一个正则表达式!对我来说难度好大!!
上次是说如何匹配有效数字(http://expert.csdn.net/Expert/topic/1922/1922536.xml?temp=.7250482),这次来说匹配html标签,严格地说是部分HTML标签——有开头结尾的那种,如<html></html>,不是<br>这种。
微软的帮助上有一个匹配HTML 标记的正则表达式例子:^<(.*)>.*<\/\1>$,但是不够严格了,象<a></b>、< ></ >它也算!
现在我写了一个^<\S+>.*<\S+>$,还是不行,不知道怎么做到前后一致,也就是它还是认为<a></b>这种组合是有效的。
后来我用变量来统一前后:
str="html"
re=new RegExp("^<"+str+">.*</"+str+">$","g")
可是这样好死板!
那么单在正则表达式里面怎么解决这个问题呢?