您的位置:首页 > Web前端 > HTML

C#字符串去除html标记

2008-12-04 12:54 302 查看
在使用Freetextbox等流行编辑器后获得的文字内容里会掺杂着一些html标记,有时会需要将它们处理掉,这里给出处理的方法,使用了正则表达式进行规则过滤,由于html标记都是基于<>这种格式,而且还有类似 这样的符号,所以分了2次处理将字符串处理为无html格式的字符串。

string html = @"<span lang="EN-US">”</span>,用户可以随时接收喜欢的视频电视内容。<span lang="EN-US"><a target="_blank" href="http://info.tele.hc360.com/list/mobile.shtml"><span lang="EN-US"><span lang="EN-US">手机</span></span></a></span>";

2

3string StrNohtml = System.Text.RegularExpressions.Regex.Replace(html, "<[^>]+>", "");

4

5StrNohtml=System.Text.RegularExpressions.Regex.Replace(StrNohtml, "&[^;]+;", "");

6

7Console.WriteLine(StrNohtml);

8
内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息
标签: