首页手记《Python3网络爬虫开发实战》的猫眼爬取（

《Python3网络爬虫开发实战》的猫眼爬取（

标签：

Python

目前正在学Python爬虫，正在读崔庆才的《Python3网络爬虫开发实战》，之前学习正则表达式，但是由于太难，最后放弃了（学渣的眼泪。。。。），在这本书上的抓取猫眼电影排行上，后来自学了pyquery，发现用pyquery可以解决这个问题，目前自己试着写了代码

附上代码：

import requests
from pyquery import PyQuery as pq
import time

def get_one_page(url):

headers = {    'User-Agent':'Mozilla/5.0 (Windows NT 10.0; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/67.0.3396.79 Safari/537.36'}

html = requests.get(url=url,headers=headers)return html.text

def parse_one_page(html):

doc = pq(html)

items = doc('dd').items()for item in items:

    item1 = item.find('.board-item-main .board-item-content .movie-item-info')#空格表示嵌套

    item2 = item.find('.board-index')    print('名次:' + item2.text())

    name = item1.find('.name').text()

    star = item1.find('.star').text()

    time = item1.find('.releasetime').text()

    score = item1.siblings('.movie-item-number .score .integer').text() + item1.siblings('.movie-item-number .score .fraction').text()    print('电影名:' + name + '\n' +

          star + '\n' + time + '\n' + '评分:'+score +'\n')

def main(offset):

url = 'http://maoyan.com/board/4?offset=' + str(offset) #设置偏移量html = get_one_page(url)

parse_one_page(html)

if name == 'main':

for i in range(10):

    main(offset = i * 10)

    time.sleep(1)#由于现在猫眼多了反爬虫，如果速度过快则无响应，所以要添加延时等待。

抱歉，第一次用MarkDown编辑器。。。。

作者：PJCK
链接：https://www.jianshu.com/p/2c224c8b90ce

点击查看更多内容

为 TA 点赞

若觉得本文不错，就分享一下吧！

评论

评论

共同学习，写下你的评论

评论加载中...

展开查看更多评论

作者其他优质文章

正在加载中

青春有我

JAVA开发工程师

手记
篇

粉丝

205

获赞与收藏

1011

关注作者，订阅最新文章

阅读免费教程

Python 办公自动化教程

17个小节 27555 930

Python 算法入门教程

15个小节 30305 1172

Python 进阶应用教程

38个小节 73051 1146

推荐

评论

收藏

共同学习，写下你的评论



感谢您的支持，我会继续努力的～

扫码打赏，你说多少就多少

赞赏金额会直接到老师账户

支付方式

打开微信扫一扫，即可进行扫码打赏哦

今天注册有机会得

100积分直接送

付费专栏免费学

大额优惠券免费领

立即参与放弃机会

点击
抽奖

慕课手记新用户专享福利

恭喜你，你的运气太好了，居然抽中了 100个积分！

恭喜你，抽中了价值元的专栏！

太棒了，直接落到你账户里！

积分商城里的罗技鼠标、机械键盘、
Kindle 阅读器、小米平衡车
Apple iPad （10.2英寸）、大额优惠券
在等着你去兑换了噢

作者：

免费赠送

兑换码：1111222211 复制

优惠券可用于购买实战课、体系课
无门槛使用

先去看看，有什么好东西马上兑换我爱学习，选课去


热搜

最近搜索清空

《Python3网络爬虫开发实战》的猫眼爬取（

阅读免费教程