selenium与xpath之获取指定位置的元素的实现


Posted in Python onJanuary 26, 2021

今天有点新的与大家分享,关于selenium与xpath之间爬数据获取指定位置的时候,方式不一样哦。

详情可以看我的代码,以b站来看好吧:

selenium与xpath之获取指定位置的元素的实现

查看这href元素,如果是xpath,肯定这么写是没有问题的:

i.find_element_by_xpath('./a/@href')

但你再selenium里面这样写会报错,所以要改成这样

i.find_element_by_xpath('./a').get_attribute('href')

这样方可正确

这是一个小案例,关于爬取b站音乐视频,但我的技术水平有限,无法下载,找不到那个东东

大家如果知道如何下载可以在评论区留言,嘿嘿

import requests
from selenium.webdriver import Chrome,ChromeOptions
#后面越来越多喜欢用函数来实现了
def get_webhot():  #热搜函数
  headers = {
    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/87.0.4280.141 Safari/537.36'
  }
  url ="https://www.bilibili.com/" # 微博的地址

  res = requests.get(url)
  #这个就是再后台上面运行那个浏览器,不在表面上占用你的
  option = ChromeOptions()
  option.add_argument('--headless')
  option.add_argument("--no-sandbox")
  #这里也要输入
  browser = Chrome(options=option)
  browser.get(url)
  #解析那个web热搜前,按住ctrl+f会在下面出现一个框框,然后改就完事
  browser.find_element_by_xpath('//*[@id="primaryChannelMenu"]/span[3]/div/a/span').click()
  c = browser.find_elements_by_xpath('//*[@id="high_energy"]/div[1]/div[2]/div')
  for i in c:
    #这里一定要注意,在selenium中不能像xpath那样写('./a/@href')来获取指定的位置,要报错,只能这么获取,查了很久
    detail_url = i.find_element_by_xpath('./a').get_attribute('href')
    name = i.find_element_by_xpath('./a/p').get_attribute('title')
    detail_page_text = requests.get(url=detail_url,headers = headers).text
    print(detail_url,name)
#运行完事
get_webhot()

这是这个结果

selenium与xpath之获取指定位置的元素的实现

到此这篇关于selenium与xpath之获取指定位置的元素的实现的文章就介绍到这了,更多相关selenium与xpath指定位置元素内容请搜索三水点靠木以前的文章或继续浏览下面的相关文章希望大家以后多多支持三水点靠木!

Python 相关文章推荐
python类的继承实例详解
Mar 30 Python
Python 40行代码实现人脸识别功能
Apr 02 Python
通过源码分析Python中的切片赋值
May 08 Python
Python实现字符串逆序输出功能示例
Jun 24 Python
Python操作csv文件实例详解
Jul 31 Python
分享8个非常流行的 Python 可视化工具包
Jun 05 Python
使用pandas的box_plot去除异常值
Dec 10 Python
Python注释、分支结构、循环结构、伪“选择结构”用法实例分析
Jan 09 Python
Python 一行代码能实现丧心病狂的功能
Jan 18 Python
基于python实现查询ip地址来源
Jun 02 Python
python实现逻辑回归的示例
Oct 09 Python
解决Pycharm 运行后没有输出的问题
Feb 05 Python
详解Python中的Lock和Rlock
Jan 26 #Python
5分钟快速掌握Python定时任务框架的实现
Jan 26 #Python
Python爬虫自动化爬取b站实时弹幕实例方法
Jan 26 #Python
python 实现的车牌识别项目
Jan 25 #Python
Python实现给PDF添加水印的方法
Jan 25 #Python
2021年值得向Python开发者推荐的VS Code扩展插件
Jan 25 #Python
numba提升python运行速度的实例方法
Jan 25 #Python
You might like
PHP配置心得包含MYSQL5乱码解决
2006/11/20 PHP
PHP实现发送邮件的方法(基于简单邮件发送类)
2015/12/17 PHP
php preg_match的匹配不同国家语言实例
2016/12/29 PHP
浅析JavaScript中的CSS属性及命名规范
2013/11/28 Javascript
使用JavaScript 编写简单计算器
2014/11/24 Javascript
node.js使用require()函数加载模块
2014/11/26 Javascript
jQuery实现的多级下拉菜单效果代码
2015/08/24 Javascript
js实现的动画导航菜单效果代码
2015/09/10 Javascript
JavaScript Uploadify文件上传实例
2017/02/28 Javascript
angular.fromJson与toJson方法用法示例
2017/05/17 Javascript
微信小程序开发之实现自定义Toast弹框
2017/06/08 Javascript
基于JS对象创建常用方式及原理分析
2017/06/28 Javascript
vue中axios的封装问题(简易版拦截,get,post)
2018/06/15 Javascript
Vue框架下引入ActiveX控件的问题解决
2019/03/25 Javascript
微信小程序获取当前位置和城市名
2019/11/13 Javascript
微信小程序之滑动页面隐藏和显示组件功能的实现代码
2020/06/19 Javascript
谈一谈vue请求数据放在created好还是mounted里好
2020/07/27 Javascript
[37:37]DAC2018 4.4 淘汰赛 Optic vs Mineski 第二场
2018/04/05 DOTA
一个基于flask的web应用诞生 bootstrap框架美化(3)
2017/04/11 Python
Python中标准模块importlib详解
2017/04/16 Python
Python cookbook(数据结构与算法)对切片命名清除索引的方法
2018/03/13 Python
Python如何使用k-means方法将列表中相似的句子归类
2019/08/08 Python
pytorch 改变tensor尺寸的实现
2020/01/03 Python
利用matplotlib为图片上添加触发事件进行交互
2020/04/23 Python
python两种注释用法的示例
2020/10/09 Python
HTML利用九宫格原理进行网页布局
2020/03/13 HTML / CSS
Linux管理员面试题 Linux admin interview questions
2014/11/01 面试题
高分子材料个人求职信范文
2013/09/25 职场文书
室内设计专业学生的自我评价分享
2013/11/27 职场文书
公司培训欢迎词
2014/01/10 职场文书
七一党建活动方案
2014/01/28 职场文书
车间机修工岗位职责
2014/02/28 职场文书
篮球社团活动总结
2014/06/27 职场文书
房地产销售主管岗位职责
2015/02/13 职场文书
电视新闻稿
2015/07/17 职场文书
丧事答谢词大全
2015/09/30 职场文书