美文网首页
爬虫游戏第一关

爬虫游戏第一关

作者: pkxutao | 来源:发表于2017-12-27 21:03 被阅读24次

发现个爬虫闯关游戏网站,挺有意思,点击跳转
进入首页,发现内容很简单,如图

第一关首页
提示在网址后面输入数字14901,按照要求做,访问http://www.heibanke.com/lesson/crawler_ex00/14901
得到如下内容
image.png
看到这里就明白了,第一关内容就是不断在网址后面添加当前页面返回的那串数字,直到得到最后一串数字就算过关,很简单,提取那串数字添加到网址后面访问,循环这个步骤,直到过关。
分析html结构,就是h3那一句就行了
html结构
爬虫代码
from urllib import request
from bs4 import BeautifulSoup
import re
def get_page(url):
    print('get url %s' % url)
    headers = {
        'User-Agent': r'Mozilla/5.0 (Windows NT 6.1; WOW64) AppleWebKit/537.36 (KHTML, like Gecko) '
                    r'Chrome/45.0.2454.85 Safari/537.36 115Browser/6.0.3',
        'Connection': 'keep-alive'
    }
    req = request.Request(url, headers=headers)
    page = request.urlopen(req).read()
    page = page.decode('utf-8')
    return page
count = 1
numResult = ' '
# 判断numResult是否为空,为空则代表闯关成功
while numResult:
    print('第%d次请求' % count)
    url = "http://www.heibanke.com/lesson/crawler_ex00/" + numResult
    result = get_page(url)
    soup = BeautifulSoup(result, "html.parser")
    # 解析h3元素
    h3 = soup.find_all("h3")[0]
    result = soup.find_all("h3")[0].text
    # 解析出数字
    numResult = re.sub("\D", "", result)
    print('数字: %s' % numResult)
    count += 1
print('成功闯关,url:%s' % url)

结果:

结果
访问http://www.heibanke.com/lesson/crawler_ex00/30366/,果然成功
成功闯关

相关文章

  • 爬虫游戏第一关

    发现个爬虫闯关游戏网站,挺有意思,点击跳转进入首页,发现内容很简单,如图 结果:

  • 【爬虫】通关黑板客爬虫闯关游戏

    最近看到的一个关于Python爬虫的闯关游戏,手痒,试他一试。 第一关 地址:http://www.heibank...

  • Python入门三天体验课

    第一关:爬虫小白的进阶之路 前言 欢迎来和我们一起探究Python的奥妙。 本次课程共分为三天,你将学到爬虫基础知...

  • Python 爬虫闯关(第二关)

    在上次第一关爬虫闯关成功后,我们会得到第二关的地址:http://www.heibanke.com/lesson/...

  • 关于“羊了个羊”

    这游戏有这么难吗,第一关我都过了一千多次了。 羊了个羊起码第一关我可以过,你的感情我连第一关都过不了。 别玩羊了个...

  • Git小游戏通关小攻略1

    Git小游戏网址:https://learngitbranching.js.org/?NODEMO 第一关:实现增...

  • 游戏第一关

    在游戏的第一关,主人公在一家制药公司上班。刚刚经历过自然流产的他,对婚姻失去了希望,现在他把活下去的动力主要来源于...

  • Python 爬虫闯关(第一关)

    在学习爬虫时,遇到了一个有意思的网站,这个网站设置了几个关卡,需要经过爬虫进行闯关,随着关卡的网后,难度不断增加,...

  • 网络爬虫源码分享

    1.淘宝网商品爬虫源码 2.豌豆荚游戏排行榜爬虫源码 3.尚妆网爬虫源码 4.糗事百科爬虫源码 5.京东商品信息和...

  • 2018-07-20《奥源书》:人类来源、灵魂来源、人类灵魂为什

    《奥源书》:人类来源、灵魂来源、人类灵魂为什么存在游戏进化图 游戏设置了无数关,而人类总在第一关重复,且乐不思蜀。...

网友评论

      本文标题:爬虫游戏第一关

      本文链接:https://www.haomeiwen.com/subject/gwrpgxtx.html