Python爬虫包BeautifulSoup异常处理(二)


Posted in Python onJune 17, 2018

面对网络不稳定,页面更新等问题,很可能出现程序异常的问题,所以我们要对程序进行一些异常处理。大家可能觉得处理异常是一个比较麻烦的活,但在面对复杂网页和任务的时候,无疑成为一个很好的代码习惯。

网页‘404'、‘500'等问题

try:
    html = urlopen('http://www.pmcaff.com/2221')
  except HTTPError as e:
    print(e)

返回的是空网页

if html is None:
    print('没有找到网页')

目标标签在网页中缺失

try:
    #不存在的标签
    content = bsObj.nonExistingTag.anotherTag 
  except AttributeError as e:
    print('没有找到你想要的标签')
  else:
    if content == None:
      print('没有找到你想要的标签')
    else:
      print(content)

实例

if sys.version_info[0] == 2:
  from urllib2 import urlopen # Python 2
  from urllib2 import HTTPError
else:
  from urllib.request import urlopen # Python3
  from urllib.error import HTTPError
from bs4 import BeautifulSoup
import sys


def getTitle(url):
  try:
    html = urlopen(url)
  except HTTPError as e:
    print(e)
    return None
  try:
    bsObj = BeautifulSoup(html.read())
    title = bsObj.body.h1
  except AttributeError as e:
    return None
  return title

title = getTitle("http://www.pythonscraping.com/exercises/exercise1.html")
if title == None:
  print("Title could not be found")
else:
  print(title)

以上全部为本篇文章的全部内容,希望对大家的学习有所帮助,也希望大家多多支持三水点靠木。

Python 相关文章推荐
跟老齐学Python之再深点,更懂list
Sep 20 Python
Python做简单的字符串匹配详解
Mar 21 Python
Python列表list内建函数用法实例分析【insert、remove、index、pop等】
Jul 24 Python
python使用Turtle库绘制动态钟表
Nov 19 Python
python微信好友数据分析详解
Nov 19 Python
python用pandas数据加载、存储与文件格式的实例
Dec 07 Python
pytorch索引查找 index_select的例子
Aug 18 Python
基于Python检测动态物体颜色过程解析
Dec 04 Python
PyCharm汉化安装及永久激活详细教程(靠谱)
Jan 16 Python
python矩阵运算,转置,逆运算,共轭矩阵实例
May 11 Python
解决Python Matplotlib绘图数据点位置错乱问题
May 16 Python
Pycharm插件(Grep Console)自定义规则输出颜色日志的方法
May 27 Python
Python爬虫包BeautifulSoup简介与安装(一)
Jun 17 #Python
python主线程捕获子线程的方法
Jun 17 #Python
Python实现获取邮箱内容并解析的方法示例
Jun 16 #Python
Python实现自定义函数的5种常见形式分析
Jun 16 #Python
Python基于jieba库进行简单分词及词云功能实现方法
Jun 16 #Python
Python实现简单的文本相似度分析操作详解
Jun 16 #Python
Django跨域请求问题的解决方法示例
Jun 16 #Python
You might like
linux php mysql数据库备份实现代码
2009/03/10 PHP
PHP中如何调用webservice的实例参考
2013/04/25 PHP
linux下为php添加iconv模块的方法
2016/02/28 PHP
JavaScript的21条基本知识点
2014/03/04 Javascript
你可能不知道的JavaScript的new Function()方法
2014/04/17 Javascript
鼠标事件的screenY,pageY,clientY,layerY,offsetY属性详解
2015/03/12 Javascript
javascript实现可全选、反选及删除表格的方法
2015/05/15 Javascript
javascript常见数据验证插件大全
2015/08/03 Javascript
很棒的js Tab选项卡切换效果
2016/08/30 Javascript
javascript代码调试之console.log 用法图文详解
2016/09/30 Javascript
JS+HTML5 FileReader对象用法示例
2017/04/07 Javascript
vue基于Vue2.0和高德地图的地图组件实例
2017/04/28 Javascript
vue-cli结合Element-ui基于cropper.js封装vue实现图片裁剪组件功能
2018/03/01 Javascript
vue2单元测试环境搭建
2018/05/24 Javascript
使用VUE实现在table中文字信息超过5个隐藏鼠标移到时弹窗显示全部
2019/09/16 Javascript
关于Vue中axios的封装实例详解
2019/10/20 Javascript
JS替换字符串中指定位置的字符(多种方法)
2020/05/28 Javascript
详解微信小程序轨迹回放实现及遇到的坑
2021/02/02 Javascript
[01:10:02]IG vs Winstrike 2018国际邀请赛小组赛BO2 第一场 8.19
2018/08/21 DOTA
python实现定制交互式命令行的方法
2014/07/03 Python
Python中optionParser模块的使用方法实例教程
2014/08/29 Python
Python内建函数之raw_input()与input()代码解析
2017/10/26 Python
python实现pdf转换成word/txt纯文本文件
2018/06/07 Python
python监控文件并且发送告警邮件
2018/06/21 Python
python实现自动发送报警监控邮件
2018/06/21 Python
Python中的list与tuple集合区别解析
2019/10/12 Python
Python urlencode和unquote函数使用实例解析
2020/03/31 Python
Python通过类的组合模拟街道红绿灯
2020/09/16 Python
tensorflow与numpy的版本兼容性问题的解决
2021/01/08 Python
请说出几个常用的异常类
2013/01/08 面试题
保险专业自荐信范文
2014/02/20 职场文书
中介业务员岗位职责
2014/04/09 职场文书
出国签证在职证明
2014/09/20 职场文书
党支部对转正的意见
2015/06/02 职场文书
Mysql外键约束的创建与删除的使用
2022/03/03 MySQL
如何通过cmd 连接阿里云服务器
2022/04/18 Servers