BeautifulSoup(2) 1.遍历文档树在解析文档文件的过程中,如果需要遍历文档,我们需要使用到一些特殊的方法。例如:1).contents获取Tag的所有子节点,以列表的形式返回。例如:con=soup.head.contentsforiincon:print(i)先把tag的.content对象以列表的形式存储在con中, Python爬虫 2022年03月21日 88 点赞 0 评论 100660 浏览
Python爬虫协议 当我们真正接触了爬虫之后会发现爬虫的功能十分强大,但是我们并不能为所欲为的使用爬虫,爬虫需要遵循robots协议,该协议是国际互联网界通行的道德规范,每一个爬虫都应该遵守,本节我们就来介绍一下爬虫协议。1.违规案例(1)——BE违规抓取eBay十二年前, Python爬虫 2022年02月25日 190 点赞 0 评论 119316 浏览
Python爬虫入门抓取豆瓣内容三(附完整代码) 上一节我们通过数据分析,找到了我们想要的内容,我们这一节就把这些内容保存到数据库中,来方便我们随时查看。本节我们采用PyMySQL数据库以及txt文件两种方式来保存数据。1.完整代码importreimportrequestsimportpymysqlfrombs4importBeautifulSou Python实战项目 2022年04月12日 214 点赞 0 评论 116758 浏览
Python爬虫入门抓取天气信息 问题:获取苏州8-15天的天气信息,包含:日期、天气、温度、风力等信息,然后将数据存入一个文档中,网址为:http://www.weather.com.cn/weather/101190401.shtml。1.问题分析首先我们进入天气网,然后开始对页面进行分析。 Python爬虫 2022年03月03日 192 点赞 0 评论 104616 浏览
Python爬虫技术基础(1)-网络请求 我们在使用爬虫的时候离不开URL地址和下载页面,首先我们就来了解一下URL。它的语法格式一般为:protocol://hostname[:port]/path/[;parameters][?query]#fragmentURL由三部分组成,第一部分是协议, Python爬虫 2022年03月26日 171 点赞 0 评论 75385 浏览
Python窗口程序实现翻译器一 实战内容:完成一个简单的翻译器程序,翻译器的效果图如下。在翻译内容中输入信息,点击翻译,如下图。设计理念:在输入框中填入我们需要翻译的内容,然后点击翻译按钮完成翻译,在对话框中显示翻译出的内容。点击确定可以进行其他内容的翻译,点击关闭按钮则结束程序,我们设计一个中英互译的翻译器。 Python实战项目 2022年03月09日 175 点赞 0 评论 109964 浏览
Python爬虫技术基础(2)-headers处理及网络超时 有时我们发送的网络请求可能会被服务器拒绝这可能是该网站设置了反爬虫机制来防止用户恶意采集信息,但这不代表我们不能访问该网站,我们可以模拟服务器的头部信息去访问。1.请求headers处理我们首先打开我们要访问的网站,然后根据浏览器的打开方式进入检查页面, Python爬虫 2022年04月13日 163 点赞 0 评论 103925 浏览
Python窗口程序实现翻译器二 1.网页分析首先要选择一个翻译网站,在这里我们选择有道翻译,进入网站:http://fanyi.youdao.com/然后检查元素,这里我们直接在network中可能找不到相应信息,我们在输入框中输入随机内容,然后点击翻译,这时就会发生变化。 Python实战项目 2022年01月02日 122 点赞 0 评论 88995 浏览
Python正则表达式(1) 在学习爬虫的过程中,正则表达式能够帮助我们根据某些复杂的规则去处理复杂的字符串,它是一个特殊的字符序列,在Python中,系统自带的re模块包含了正则表达式的全部功能,下面我们进入正则表达式的学习。1.元字符正则表达式的结构由普通字符和元字符组成, Python爬虫 2022年04月17日 110 点赞 0 评论 81496 浏览
Python窗口程序实现翻译器三 前面我们对图形界面进行了设计并通过爬虫完成了翻译功能,这一节我们就把前面的内容结合到一起完成翻译器的制作。1.完整代码importwximporturllib.request#导入模块importurllib.parseimportjsonclassMyFrame(wx.Frame):def__ini Python实战项目 2022年04月17日 107 点赞 0 评论 108257 浏览