python爬虫之爬取笔趣阁小说-巨人网络通讯

主页 > 知识库 > python爬虫之爬取笔趣阁小说

python爬虫之爬取笔趣阁小说

前言

为了上班摸鱼方便，今天自己写了个爬取笔趣阁小说的程序。好吧，其实就是找个目的学习python，分享一下。

一、首先导入相关的模块

import os
import requests
from bs4 import BeautifulSoup

二、向网站发送请求并获取网站数据

网站链接最后的一位数字为一本书的id值，一个数字对应一本小说，我们以id为1的小说为示例。

进入到网站之后，我们发现有一个章节列表，那么我们首先完成对小说列表名称的抓取

# 声明请求头
headers = {
	'User-Agent': 'Mozilla/5.0 (Windows NT 10.0) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/88.0.4324.182 Safari/537.36'
}

# 创建保存小说文本的文件夹
if not os.path.exists('./小说'):
    os.mkdir('./小说/')
    
# 访问网站并获取页面数据
response = requests.get('http://www.biquw.com/book/1/').text
print(response)

写到这个地方同学们可能会发现了一个问题，当我去正常访问网站的时候为什么返回回来的数据是乱码呢？

这是因为页面html的编码格式与我们python访问并拿到数据的解码格式不一致导致的，python默认的解码方式为utf-8，但是页面编码可能是GBK或者是GB2312等，所以我们需要让python代码很具页面的解码方式自动变化

#### 重新编写访问代码
```python
response = requests.get('http://www.biquw.com/book/1/')
response.encoding = response.apparent_encoding
print(response.text)

'''
这种方式返回的中文数据才是正确的
'''

三、拿到页面数据之后对数据进行提取

当大家通过正确的解码方式拿到页面数据之后，接下来需要完成静态页面分析了。我们需要从整个网页数据中拿到我们想要的数据(章节列表数据)

1.首先打开浏览器

2.按F12调出开发者工具

3.选中元素选择器

4.在页面中选中我们想要的数据并定位元素

5.观察数据所存在的元素标签

'''
根据上图所示，数据是保存在a标签当中的。a的父标签为li，li的父标签为ul标签，ul标签之上为div标签。所以如果想要获取整个页面的小说章节数据，那么需要先获取div标签。并且div标签中包含了class属性，我们可以通过class属性获取指定的div标签，详情看代码~
'''
# lxml: html解析库 将html代码转成python对象，python可以对html代码进行控制
soup = BeautifulSoup(response.text, 'lxml')
book_list = soup.find('div', class_='book_list').find_all('a')
# soup对象获取批量数据后返回的是一个列表，我们可以对列表进行迭代提取
for book in book_list:
    book_name = book.text
    # 获取到列表数据之后，需要获取文章详情页的链接，链接在a标签的href属性中
    book_url = book['href']

四、获取到小说详情页链接之后进行详情页二次访问并获取文章数据

book_info_html = requests.get('http://www.biquw.com/book/1/' + book_url, headers=headers)
book_info_html.encoding = book_info_html.apparent_encoding
soup = BeautifulSoup(book_info_html.text, 'lxml')

五、对小说详情页进行静态页面分析

info = soup.find('div', id='htmlContent')
print(info.text)

六、数据下载

with open('./小说/' + book_name + '.txt', 'a', encoding='utf-8') as f:
    f.write(info.text)

最后让我们看一下代码效果吧~

抓取的数据

到此这篇关于python爬虫之爬取笔趣阁小说的文章就介绍到这了,更多相关python爬取小说内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家！

您可能感兴趣的文章:

python 爬取国内小说网站
Python爬虫入门教程02之笔趣阁小说爬取
python 爬取小说并下载的示例
python爬取”顶点小说网“《纯阳剑尊》的示例代码
Python爬取365好书中小说代码实例
Python实现的爬取小说爬虫功能示例
Python scrapy爬取起点中文网小说榜单

标签：日照赤峰阳泉双鸭山克拉玛依贵州临汾金华

巨人网络通讯声明：本文标题《python爬虫之爬取笔趣阁小说》，本文关键词 python,爬虫,之爬,取笔,趣阁,；如发现本文内容存在版权问题，烦请提供相关信息告之我们，我们将及时沟通与处理。本站内容系统采集于网络，涉及言论、版权与本站无关。

下面列出与本文章《python爬虫之爬取笔趣阁小说》相关的同类信息！

python爬虫之爬取笔趣阁小说

10-18

中牟百应电销机器人加盟（中牟百应电销机器人

本文目录一览：1、跟电话机器人公司协作,上圈套了怎么办2、为什么越来越多的人挑选电话机器人项目创业3、电话机器人...

11-29

新一线城市研究所、ofo联合发布：南京每天超2千人骑车起点为新街口地铁

第一财经·新一线城市研究所与ofo小黄车最新联合发布了“共享单车城市出行大数据”，并解读了南京整座城市的共享单车出...

10-16

苏州电销机器人免费领（智能电销机器人购买）

本篇文章给我们谈谈姑苏电销机器人免费领，以及智能电销机器人购买对应的知识点，期望对各位有所协助，不要忘了保藏本...

11-06

PowerShell ISE自动化简单示例

PowerShell ISE的自动化不依赖与任何第三方的框架和工具，因为PowerShell ISE本身就是可编程的。非常高大上地被称作为PowerShell抽...

10-18

$[city_name]电销卡哪里购买好（电销电话卡哪个比较便宜）

今天给各位分享电销卡哪里购买好的知识，其中也会对电销电话卡哪个比较便宜进行解释，如果能碰巧解决你现在面临的问题...

06-02

杭州电话外呼系统价格（杭州呼叫中心）

本文目次一览： 1、外呼零碎几何钱一个月？ 2、德律风外呼零碎几何钱？ 3、电销外呼零碎几何钱一个月？ 4、外呼零碎一个...

11-25

南通高频电销卡批发

南通高频电销卡批发本公司目前已经与多家虚拟运营商联签约，共创虚商大业，提供了业务整合的平台！服务宗旨：只给客...

11-15

如何获得没有地图标注商家信息？如何获得位置信息？

C#如何获得百度地图点上的信息框？百度地图是提供了一个js API 你需要什么需要用js获取，在ajax发到后台去如何采集百度地...

11-26

办理400电话打破企业“生死劫”（企业400电话办理怎样做）

11-07

极光大数据：国内手机市场年中大盘点

2017 年第二季度，苹果十周年新机型蓄势待发。安卓阵营华为卫冕销量冠军，vivo则登上亚军宝座。中国领先的移动大数据办事...

10-16

许昌手机外呼系统（电销手机外呼系统）

本文目录一览：1、外呼体系是怎样用的？2、外呼体系怎样用？我也是做电销的，打电话打多了就会被封号3、什么是网络电话...

11-29

保定市防封高频电话卡便宜

全国建“合伙人”制分公司有了战略和产品，开拓用户是分享通信集团下一步的重心。据了解，分享通信集团以“分享”的理...

02-15

联通400电话固定费用400电话办理具体的收费标准是什么？

作为全国统一的强大虚拟总机，400电话号码没有9位数字，都是从400开始的，但是运营商不同，数字段不同。联通400电话目前...

01-13

为什么企业对 400 电话感兴趣？（企业对400电话感兴趣原因是什么）

很多企业都非常重视电话业务，所以选择一个非常合适的电话号码对企业来说也很重要企业对400电话感兴趣原因是什么在掌...

07-21

丽水电销机器人厂家

汇港通科技组装于2018年，是一家潜心于大中小企业精准经营销售和企业管理效劳处置计划的供给商。呼叫中心经营管理，巨...

10-31

苏州电销机器人哪家有卖（苏州家用机器人）

本文目录一览： 1、电话销售机器人哪个好2、电销机器人都有哪些性价比高的品牌？3、电话ai机器人在哪能买4、电销机器人...

11-27

徐州电话机器人厂家招聘（江苏机器人厂招聘）

本文目录一览： 1、怎么查询个人征信报告？ 2、越来越多人做电销机器人了，电销机器人哪家好呢？ 3、没有用的比较好的电...

11-25

400电话，走进行业领先的推广

400电话，这是一个选择永久性号码的平台，也是很多行业进入到发展阶段过程中所需要把握的一种宣传模式，到底怎么样才能...

03-12

电销防封软件真的可以防封号吗?

现在的电销行业越来越难做了，原因无他，就是运营商封号太严重了。每天打不了多少电话就会有封号的危险。这对电销业务...

12-03

品牌商标转让一般要多少天才能进行使用？

现在要以什么样的方式，才可以快速完成品牌商标转让流程呢？对此有疑问的朋友，只要不断了解相关的事情，很快就会知...

10-23

化妆品商标注册

化妆品作为一种品牌盈利能力很强的产品，商标注册显然是最重要的。销售的作用反而是其次，生产环节的盈利能力最差。从...

10-23

400电话资费400元电话资费标准

400电话资费400元电话资费标准以下内容由巨人小编整理发布。 50元/月，83元/月，138元/月。400电话已经成为企业的必须品，...

02-20

加速AI应用，思必驰在2019全球人工智能产品应用博览会

5月9日，由苏州市人民政府、新一代人工智能产业技术创新战略联盟共同主办的2019全球人工智能产品应用博览会（以下简称全...

10-19

电销团队怎么抓人（电销团队犯法吗）

今天给各位分享电销团队怎么抓人的知识，其中也会对电销团队犯法吗进行解释，如果能碰巧解决你现在面临的问题，别忘了...

08-27

网上购买物联卡靠谱吗

在这个万物互联的时代，针对于企业设备联网的物联卡就显得格外重要了，而共享单车，移动支付，智慧城市，自动售卖机等...

11-07

佛山销售外呼系统收费（外呼营销违法吗）

本文目录一览： 1、外呼体系多少钱一个月？2、电销外呼体系多少钱一个月？3、电销外呼体系一个月贵吗？4、外呼体系装置...

04-22

观察呼叫中心外包运营有感

09年6月下旬的某日，盆地中的台北天气闷热，电脑惯例地持续收到各方邮件。刚巧公务缠身，本想只要不是紧急状况就先搁着...

10-22

电销团队海报手绘（电销团队名称和激励口号）

本文目录一览： 1、海报怎样画手绘2、制造手绘POP海报的6大过程与技巧3、手绘POP海报的过程及技巧4、怎样手绘pop海报5、手...

04-22

南京房产外呼电话一企嗨呼叫系统,AXB线路厂家-实力认证

一企嗨电话营销系统 1．当前的电销场景有哪些困扰？ 1）手机.卡频繁被封，电销业务难以启动； 2）销售人员号码被标注，...

12-17

东莞财税专用ai电话机器人价格-哪家专业？

东莞财税专用ai电话机器人价格反正我是无法理解的。值得一提的是在这份榜单中，呼叫中心系统服务商的表现给人眼前一亮...

05-17

商务部与加拿大中国贸易理事会服务外包合作交流会成功举行

10月4日，商务部与加中贸易理事会在加拿大多伦多举办了2013年中加服务外包合作交流会。加中贸易理事会Neil Tait副主席和中...

10-22

关于大都会人寿电销是外包么的信息

本篇文章给大家谈谈大都会人寿电销是外包么，以及对应的知识点，希望对各位有所帮助，不要忘了收藏本站喔。本文目录...

08-28

智呼宝ai电话机器人（电话智能机器人）

本文目次一览： 1、什么是AI智能德律风呆板人？ 2、智能德律风呆板人可行吗？ 3、AI智能德律风呆板人 4、ai智能德律风呆板...

11-25

400电话续费的套餐还是和以前一样的吧？

400电话新续费的套餐跟之前签订的合同是一样的，除非您要提高续费的标准，只能提高不能降低。...

12-22

Javascript中使用exec进行正则表达式全局匹配时的注意事项

本文就是介绍在使用 Javascript 中使用 exec 进行正则表达式全局匹配时的注意事项。先看一下常见的用法：复制代码代码如下...

10-18

中高端服务外包人才来锡创业可获安家费补贴

无锡服务外包企业若获得世界500强企业的大额外包合同，本地工业企业若向123计划企业发包，符合这样的条件都将得到奖励。...

10-22

伊娃机器人效果怎么样

时代在发展，科技在进步，无论你的企业在行业中处于什么样的地位，无论你的企业在市场上占多大的份额，无论你的企业在...

10-31

云呼叫中心年增近20% 获电商企业青睐

中国软件资讯网消息，近期，基于云计算技术的呼叫中心受到业界的关注，并逐步成为了企业发展电子商务的新动力。由于云...

10-22

linux学习笔记

linux目录架构 / 根目录 /bin 常用的命令 binary file 的目錄 /boot 存放系统启动时必须读取的档案，包括核心 (kernel) 在内 /boot/gr...

10-20

centos安装php5、卸载php、安装php7的教程

首先安装php5很简单 yum install php 然后如果不想用php5的话那就卸载吧注意只使用yum remove命令是行不通的那我们先 yum remove p...

10-16

上海电销公司外呼用什么软件

上海电销公司外呼用什么软件,办理上海电销外呼软件,上海电销软件办理防封号电销软件，提供多种防封解决方案，支持各地...

12-03

电销机器人对电销行业有着积极的促进作用

电销机器人对电销行业有着积极的促进作用，电销机器人，让客户服务体验更顺畅。电销机器人外呼系统颠覆传统自动外呼只...

10-31

外呼系统外地手机号（外呼电话号码）

本文目录一览： 1、外埠手机号码一天拨打20个外埠号码会封号么？ 2、外呼体系若何用？我也是做电销的，打电话打多了就会...

11-26

电销外呼线路都有哪些

电销外呼线路都有哪些优质的电销线路，全国套餐可选。企业呼叫中心、业务系统统一接入。解决封号难题，提供呼出率！...

12-03

电话机器人有法律效应（电话机器人违法吗）

本文目录一览：1、076912345打电话是机器人会不会坐牢2、公司老板把电话号码数据给我导入到电话机器人群呼系,我会涉嫌违法...

06-20

微软颁布颁发为Win10秋季更新10586延长6个月更新支持

目前，Windows10 共计有 5 个正式版，从Version 1507(Build 10240)到最新的1709(Build16299 秋季创意者更新)。因为敦促升级的缘故，微软...

10-15

郑州防封卡外呼系统是什么（外呼防封号系统）

本文目录一览： 1、什么是网络电话外呼体系？2、外呼体系是什么?3、外呼体系是怎样用的？什么是网络电话外呼体系？你加...

11-28

长沙电销外呼系统介绍（呼叫中心电销系统）

本篇文章给大家谈谈长沙电销外呼系统介绍，以及呼叫中心电销系统对应的知识点，希望对各位有所帮助，不要忘了收藏本站...

11-06

400电话中国移动移动400电话怎么样

移动400业务就是互联网上提到的400电话，类似于800电话，都是提供给企业的直线电话业务。与800不同的是，400电话是一项业...

01-13

黑龙江电销外呼系统好用吗（电销外呼系统哪个

本文目录一览：1、外呼体系好用吗？2、电销客外呼体系这个体系好用么？3、外呼体系怎么？好用么？4、外呼体系好用不?哪...

11-29

python爬虫之爬取笔趣阁小说

10-18

本页收集关于python爬虫之爬取笔趣阁小说的相关信息资讯供网民参考！

四合一精品企业网站建设

多一个网站就为企业多增加一条营销渠道

¥888元限时抢购

立即咨询 快速购买

企业400电话

智能AI客服机器人
￥15000

在线订购

合计11份范本：公司章程+合伙协议+出资协议+合作协议+股权转让协议+增资扩股协议+股权激励+股东会决议+董事会决议

推荐文章

上一篇：python获取淘宝服务器时间的代码示例

下一篇：python文件名批量重命名脚本实例代码

一起分享吧

python爬虫之爬取笔趣阁小说

目录

前言

一、首先导入相关的模块

二、向网站发送请求并获取网站数据

三、拿到页面数据之后对数据进行提取

四、获取到小说详情页链接之后进行详情页二次访问并获取文章数据

五、对小说详情页进行静态页面分析

六、数据下载

四合一精品企业网站建设

¥888元限时抢购

立即咨询快速购买

企业400电话

合计11份范本：公司章程+合伙协议+出资协议+合作协议+股权转让协议+增资扩股协议+股权激励+股东会决议+董事会决议

在线咨询