Python 爬虫零基础实战:25 讲批量抓取小说与图片

richard_firs 2026-08-30 19:42:46

课程名称适应人群
Python 爬虫零基础实战:25 讲批量抓取小说与图片适合人群 1. 想入门爬虫但不知从何下手的零基础学习者 2. 会一点 Python 但不会解析网页数据的初学者 3. 需要批量采集网页文本 / 图片数据的学生、研究员、运营人员 4. 想为 AI 模型、数据分析项目准备数据采集能力的开发者

课程简介

在 AI 与数据驱动的时代,数据是模型的灵魂,而爬虫是获取互联网数据的核心技能。本课程以 BeautifulSoup 为主线,从 HTML 解析基础讲起,逐步深入 CSS 选择器、标签增删改查、SoupStrainer 解析期过滤,再到 Selenium 动态页面抓取,最终通过小说网站新闻网站两个完整实战项目,带你走完从 "看懂网页" 到 "批量落地数据" 的全流程。

课程特色

  1. 一库讲透,不贪多求全 —— 围绕 BeautifulSoup 深度拆解:find_all 的 7 种参数用法(name / 正则 / 自定义函数 /attrs/string /recursive/limit)、CSS 选择器 10+ 种写法(后代、子元素、相邻兄弟、属性前缀 / 后缀 / 包含匹配)、标签修改(append /extend/decompose /replace_with),每个知识点配可运行代码。
  2. 双实战项目闭环 —— 小说网站抓取(作者页→书名→章节列表→正文提取→按目录保存 txt)+ 新闻网站图片抓取(图片信息提取→批量下载本地),覆盖文本图片两类最典型的数据场景。
  3. 静态到动态完整链路 —— 先用 requests + BeautifulSoup 搞定静态页面,再用 Selenium + WebDriver 攻克 JavaScript 渲染页面,遇到反爬或动态内容不再束手无策。
  4. 代码即讲义,学完即拿即用 —— 每节课配套独立 Python 脚本,课程附件包含全部讲解代码、HTML 样例和小说网站抓取完整版代码,可直接复用到自己的项目。
...全文
31 回复 打赏 收藏 举报
写回复
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复

1

社区成员

发帖
与我相关
我的任务
社区描述
一个平凡的人,有着不平凡的经历。
社区管理员
  • richard_firs
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
暂无公告

试试用AI创作助手写篇文章吧