社区
Java SE
帖子详情
网络爬虫网页禁止
maoruiwen
2013-10-11 01:22:31
各位大侠:
我们老大让我写个爬虫弄一个网站的数据,但是我写好了,网站阻止爬虫,我该怎么解决。谢谢。跪求。
...全文
375
5
打赏
收藏
网络爬虫网页禁止
各位大侠: 我们老大让我写个爬虫弄一个网站的数据,但是我写好了,网站阻止爬虫,我该怎么解决。谢谢。跪求。
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
5 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
maoruiwen
2015-05-09
打赏
举报
回复
谢谢大家,最近一直忙。忘记csdn上面的帖子了。
maoruiwen
2013-10-11
打赏
举报
回复
应该怎么操作?
tony4geek
2013-10-11
打赏
举报
回复
这个估计很难了。。
maoruiwen
2013-10-11
打赏
举报
回复
urlconnection.addRequestProperty("User-Agent", "Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 8.0)"); 这样可以么?
身胖不怕影子歪
2013-10-11
打赏
举报
回复
可否让爬虫模拟 浏览器来访问
爬虫
破解
网页
禁止
F12
破解
爬虫
网页
禁止
F12
使用
网络
爬虫
需要知道的准则——robots协议
前言 因为
网络
爬虫
可从服务器爬取各种内容,所以可能存在涉及个人隐私或商业机密的内容,给使用者和服务器管理者带来不必要的困扰与纠纷,所以需要robots协议来对其进行规范。正文 有些企业的服务器设置有对特定
爬虫
的拦截功能,但并不是所有企业均有能力设置和管理对
爬虫
进行拦截的功能,所以robots协议便诞生了。 此协议告知了
爬虫
爬取该网站时应遵循的准则,并详细说明了何种
爬虫
禁止
爬取何种
网页
。 我...
抓取
网页
报403错误,
爬虫
解决403
禁止
访问错误方法
抓取
网页
报403错误,
爬虫
解决403
禁止
访问错误方法
Robots
爬虫
协议
爬虫
学的好,监狱进的早。
python
网络
爬虫
与信息提取-01-requests
Requests库 requests.request() requests.put() requests.get () requests.patch() requests.head() request.delete() requests.post() get和head需要掌握; try: r = requests .get (url,timeout =30) r....
Java SE
62,621
社区成员
307,251
社区内容
发帖
与我相关
我的任务
Java SE
Java 2 Standard Edition
复制链接
扫一扫
分享
社区描述
Java 2 Standard Edition
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章