使用正则表达式提取网页正文

selg1984 2009-10-17 06:02:06
如何使用正则表达式提取网页正文?最好有代码 急
...全文
190 5 打赏 收藏 转发到动态 举报
写回复
用AI写文章
5 条回复
切换为时间正序
请发表友善的回复…
发表回复
amdgaming 2009-10-17
  • 打赏
  • 举报
回复
。。。。。
阿_布 2009-10-17
  • 打赏
  • 举报
回复
是不是提取<body>之间的内容?

import java.util.regex.Matcher;
import java.util.regex.Pattern;


public class TestHtmlBody {

public static void main(String[] args) {
String body = "<body>test get html body!</BODY>";
String pattern = "(?<=<body>).*?(?=</body>)";
Matcher matcher = Pattern.compile(pattern,Pattern.UNICODE_CASE).matcher(body);
while(matcher.find()){
System.out.println(matcher.group());
}
}
}
selg1984 2009-10-17
  • 打赏
  • 举报
回复
[Quote=引用 1 楼 dlutqw 的回复:]
java正则表达式就是用pattern和match。网上很多例子。
提取网页正文具体是什么样的需求。
[/Quote]
就是通用的那样的
wk83670607 2009-10-17
  • 打赏
  • 举报
回复
java语言很好啊
dlutqw 2009-10-17
  • 打赏
  • 举报
回复
java正则表达式就是用pattern和match。网上很多例子。
提取网页正文具体是什么样的需求。

62,621

社区成员

发帖
与我相关
我的任务
社区描述
Java 2 Standard Edition
社区管理员
  • Java SE
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧