爬虫

Python爬虫入门抓取豆瓣内容三(附完整代码)

上一节我们通过数据分析,找到了我们想要的内容,我们这一节就把这些内容保存到数据库中,来方便我们随时查看。本节我们采用PyMySQL数据库以及txt文件两种方式来保存数据。1.完整代码importreimportrequestsimportpymysqlfrombs4importBeautifulSou

Python爬虫入门抓取豆瓣内容二

1.问题分析我们在上一节爬取了网页的全部信息,下面我们还要这样html代码中找到我们所需要的内容,因此我们要根据问题进入网站中,去解析网页中的信息。从页面中可以发现,我们需要爬取的信息分别存在于不同的分区当中,那么我们来检查一下页面的元素,右键页面检查网页源代码或者F12。

Python爬虫入门抓取豆瓣内容一

实战内容:获取豆瓣TOP250电影的中英文名、港台名、导演、上映年份、电影分类以及评分,将数据存放到数据库和文件中。链接为:https://movie.douban.com/top250?start=。1.数据爬取爬取网页数据的方式我们在前面介绍过多种,下面来进行数据的爬取。

Python窗口程序实现翻译器三

前面我们对图形界面进行了设计并通过爬虫完成了翻译功能,这一节我们就把前面的内容结合到一起完成翻译器的制作。1.完整代码importwximporturllib.request#导入模块importurllib.parseimportjsonclassMyFrame(wx.Frame):def__ini

Python窗口程序实现翻译器二

1.网页分析首先要选择一个翻译网站,在这里我们选择有道翻译,进入网站:http://fanyi.youdao.com/然后检查元素,这里我们直接在network中可能找不到相应信息,我们在输入框中输入随机内容,然后点击翻译,这时就会发生变化。

Python窗口程序实现翻译器一

实战内容:完成一个简单的翻译器程序,翻译器的效果图如下。在翻译内容中输入信息,点击翻译,如下图。设计理念:在输入框中填入我们需要翻译的内容,然后点击翻译按钮完成翻译,在对话框中显示翻译出的内容。点击确定可以进行其他内容的翻译,点击关闭按钮则结束程序,我们设计一个中英互译的翻译器。

Python爬虫入门抓取天气信息

问题:获取苏州8-15天的天气信息,包含:日期、天气、温度、风力等信息,然后将数据存入一个文档中,网址为:http://www.weather.com.cn/weather/101190401.shtml。1.问题分析首先我们进入天气网,然后开始对页面进行分析。

BeautifulSoup(2)

1.遍历文档树在解析文档文件的过程中,如果需要遍历文档,我们需要使用到一些特殊的方法。例如:1).contents获取Tag的所有子节点,以列表的形式返回。例如:con=soup.head.contentsforiincon:print(i)先把tag的.content对象以列表的形式存储在con中,

BeautifulSoup(1)

BeautifulSoup在Python中是一个比较受欢迎的第三方库,它是一款比较优秀的网页解析库,里面提供了很多接口帮助我们来处理导航、搜索、修改分析树,它的查找提取功能非常好用,能够节省程序员大量的时间。BeautifulSoup最新版为BeautifulSoup4,

Python正则表达式(2)

本节我们来学习Python的内置re模块,re模块用于实现正则表达的操作,它里面提供了很多方法,例如search()、match()、findall()、split()、sub()等,下面我们依次进行学习。1.search()方法search方法在输入的字符串中查找,