Python--BeautifulSoup库安装

1.BeautifulSoup简介

BeautifulSoup库通过解析文档可以获取网页文档中所需的数据,方便用户从HTML或XHTML文档中提取数据,作为python的一个辅助工作,也是爬虫实践中的好帮手。

2.BeautifulSoup安装

刚开始的时下载了BeautifulSoup3.2.1,安装的时候就报错了

上网搜了下原来是 print "msg you want to print"是python2的语法,python3的话应该安装BeautifulSoup的更高版本

所有就重新下载压缩包BeautifulSoup4.3.2

具体步骤如下:

安装方法有两种,一种是使用pip命令安装,一种是下载压缩包安装

(1)使用pip的命令安装

如果不知道pip的安装路径或者找错了pip的安装路径,出现了:‘unknow or unsurrpotted command 'install'’的错误,可以使用命令:‘where pip’找到pip的具体目录

进入python的pip安装的路径下打开命令符‘Shift+鼠标右键’,输入命令:

pip install beautifulsoup4

(1)下载压缩包安装:到官网;https://pypi.python.org/pypi/beautifulsoup4/4.3.2下载压缩包,然后解压

(2)将解压的文件夹放在python的文件夹下:

(3)进入beautifulsoup4-4.3.2文件夹下,打开命令符,输入

setup.py build

(4)再次输入以下命令:

setup.py install

(5)验证beautifulsoup4-4.3.2是否安装成功

python
import bs4

如果没有报错则是安装成功,而我很不幸报错了,报了以下的错误:'cannot import name 'HTMLParseError'',不慌,有失败才能更加印象深刻,学到更多

其实报错的原因还是我安装的beautifulsoup版本过低,需要升级,所以现在需要升级下beautifulsoup4-4.3.2,可以使用pip命令升级

(6)使用pip命令升级

打开Python下pip的安装路径,打开命令符,输入命令

pip install --upgrade beautifulsoup4

升级成功后,关闭命令符

(7)重新验证下

python
import bs4

这下就万无一失了,成功安装了。

原文地址:https://www.cnblogs.com/evablogs/p/7387994.html