社区
Web 开发
帖子详情
百科词条名和其ID的对应关系
x363635334
2014-04-15 08:23:42
本程序想输入GetDC即用ShellExecute运行浏览器打开词条
但是百科词条url都这样的格式http://baike.baidu.com/view/1080533.htm
输入想搜的字时如何知道具体的百科网址呢
...全文
316
2
打赏
收藏
百科词条名和其ID的对应关系
本程序想输入GetDC即用ShellExecute运行浏览器打开词条 但是百科词条url都这样的格式http://baike.baidu.com/view/1080533.htm 输入想搜的字时如何知道具体的百科网址呢
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
2 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
x363635334
2014-04-16
打赏
举报
回复
引用 1 楼 defonds 的回复:
百度收录的时候,还按照关键字分配 ID?
那是不太可能的.但是 http://baike.baidu.com/search?word=GetDC 这个页面上方有大按钮一点就自动进页面了 我只打算我的程序里用关键字,因为ID应该得不到吧
Defonds
2014-04-16
打赏
举报
回复
百度收录的时候,还按照关键字分配 ID?
百度
百科
词条
爬取
本文介绍了一种爬取百度
百科
词条
信息的方法,针对百度
百科
的异步加载特性,通过分析异步请求URL和请求参数,利用POST方法获取数据,解析JSON响应并提取
词条
名
称和内容。
通过Python获取维基
百科
中概念
词条
的维基信息
介绍了一种通过Python访问维基
百科
API的方法,用于快速获取概念
词条
的相关信息,如摘要、超链接、分类等。该方法适用于自然语言处理研究者及维基
百科
爱好者。
维基中文
百科
词条
爬取实践
本文介绍了如何使用XPath和Python爬虫技术从维基中文
百科
中爬取
词条
数据。首先讲解了XPath的基础语法和节点选取方法,然后通过jieba库进行中文分词处理,最后利用lxml库解析HTML文档并保存数据到本地文件。
按条件爬取百度
百科
词条
及其相关
词条
的
ID
该博客介绍了如何使用Python爬虫按条件从百度
百科
抓取
词条
信息,包括更换请求头避免屏蔽,通过CSS选择器排除特定内容,设定搜索深度限制相关度,利用缓存避免重复搜索和记录,以及设置必须包含的关键字过滤。
Java 爬虫对
百科
词条
分类信息的抓取与处理
本文介绍如何使用Java技术栈中的Jsoup、MySQL和Apache Commons Lang3,实现对百度
百科
词条
分类信息的抓取、解析、清洗与存储。涵盖HTTP请求发送、HTML解析、反爬应对及性能优化策略,适用于知识图谱构建与行业数据分析等应用场景。
Web 开发
81,110
社区成员
341,722
社区内容
发帖
与我相关
我的任务
Web 开发
Java Web 开发
复制链接
扫一扫
分享
社区描述
Java Web 开发
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章