用htmlparser采集html内容时的问题

qiang925 2010-04-22 10:30:35
请问,当用这个htmlparser采集时,如果一个html页面里面有几十万个链接,而我又要把这几十万个链接取出来,然后再把html里面的字取出来,tomcat 经常出 out of memory,请问,有什么办法解决吗?
...全文
75 4 打赏 收藏 转发到动态 举报
写回复
用AI写文章
4 条回复
切换为时间正序
请发表友善的回复…
发表回复
cd0425 2010-04-22
  • 打赏
  • 举报
回复
没必要把所有链接都放到类存里吧 比如拿十个 处理完了 在拿下十个处理
qiang925 2010-04-22
  • 打赏
  • 举报
回复
顶顶顶顶顶顶顶顶顶顶顶顶顶顶顶顶顶顶
qiang925 2010-04-22
  • 打赏
  • 举报
回复
急问啊,弄了几天,还是内存溢出
qiang925 2010-04-22
  • 打赏
  • 举报
回复
是啊,这个我也知道,但htmlparser里面的方法,好像只提供全部取出来的,没有逐个逐个取的

62,621

社区成员

发帖
与我相关
我的任务
社区描述
Java 2 Standard Edition
社区管理员
  • Java SE
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧