C#字符串去除html标记
2008-12-04 12:54
302 查看
在使用Freetextbox等流行编辑器后获得的文字内容里会掺杂着一些html标记,有时会需要将它们处理掉,这里给出处理的方法,使用了正则表达式进行规则过滤,由于html标记都是基于<>这种格式,而且还有类似 这样的符号,所以分了2次处理将字符串处理为无html格式的字符串。
string html = @"<span lang="EN-US">”</span>,用户可以随时接收喜欢的视频电视内容。<span lang="EN-US"><a target="_blank" href="http://info.tele.hc360.com/list/mobile.shtml"><span lang="EN-US"><span lang="EN-US">手机</span></span></a></span>";
2
3string StrNohtml = System.Text.RegularExpressions.Regex.Replace(html, "<[^>]+>", "");
4
5StrNohtml=System.Text.RegularExpressions.Regex.Replace(StrNohtml, "&[^;]+;", "");
6
7Console.WriteLine(StrNohtml);
8
string html = @"<span lang="EN-US">”</span>,用户可以随时接收喜欢的视频电视内容。<span lang="EN-US"><a target="_blank" href="http://info.tele.hc360.com/list/mobile.shtml"><span lang="EN-US"><span lang="EN-US">手机</span></span></a></span>";
2
3string StrNohtml = System.Text.RegularExpressions.Regex.Replace(html, "<[^>]+>", "");
4
5StrNohtml=System.Text.RegularExpressions.Regex.Replace(StrNohtml, "&[^;]+;", "");
6
7Console.WriteLine(StrNohtml);
8
相关文章推荐
- C#字符串去除html标记
- C# 字符串去除HTML格式
- C#去除指定字符串中的HTML标签相关代码函数
- c# 去除网页源码中的HTML标记
- 用C#去除字符串中HTML的格式(清除数据库中html标签)
- C#去除指定字符串中的HTML标签相关代码函数
- C#字符串去除html格式
- 截字符串 去除HTML标记
- 字符串中去除HTML标记
- 去除字符串中的html标记及标记中的内容
- [转]C#字符串去除html格式
- 去除字符串中的html标记
- C#中如何去除HTML标记
- asp去除字符串中的html标记
- 用C#去除字符串中HTML的格式
- 截字符串 去除HTML标记
- ASP函数:截取字符串和去除HTML标记
- C#中如何去除HTML标记
- C# 替换去除HTML标记方法(正则表达式)
- 帝国 标签模板 使用程序代码 去除html标记 并 截取字符串