您当前的位置:首页 > IT编程 > python
| C语言 | Java | VB | VC | python | Android | TensorFlow | C++ | oracle | 学术与代码 | cnn卷积神经网络 | gnn | 图像修复 | Keras | 数据集 | Neo4j | 自然语言处理 | 深度学习 | 医学CAD | 医学影像 | 超参数 | pointnet | pytorch | 异常检测 | Transformers | 情感分类 | 知识图谱 |

自学教程:selenium与xpath之获取指定位置的元素的实现

51自学网 2021-10-30 23:06:09
  python
这篇教程selenium与xpath之获取指定位置的元素的实现写得很实用,希望能帮到您。

今天有点新的与大家分享,关于selenium与xpath之间爬数据获取指定位置的时候,方式不一样哦。

详情可以看我的代码,以b站来看好吧:

在这里插入图片描述

查看这href元素,如果是xpath,肯定这么写是没有问题的:

i.find_element_by_xpath('./a/@href')

但你再selenium里面这样写会报错,所以要改成这样

i.find_element_by_xpath('./a').get_attribute('href')

这样方可正确

这是一个小案例,关于爬取b站音乐视频,但我的技术水平有限,无法下载,找不到那个东东

大家如果知道如何下载可以在评论区留言,嘿嘿

import requestsfrom selenium.webdriver import Chrome,ChromeOptions#后面越来越多喜欢用函数来实现了def get_webhot():  #热搜函数  headers = {    'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/87.0.4280.141 Safari/537.36'  }  url ="https://www.bilibili.com/" # 微博的地址  res = requests.get(url)  #这个就是再后台上面运行那个浏览器,不在表面上占用你的  option = ChromeOptions()  option.add_argument('--headless')  option.add_argument("--no-sandbox")  #这里也要输入  browser = Chrome(options=option)  browser.get(url)  #解析那个web热搜前,按住ctrl+f会在下面出现一个框框,然后改就完事  browser.find_element_by_xpath('//*[@id="primaryChannelMenu"]/span[3]/div/a/span').click()  c = browser.find_elements_by_xpath('//*[@id="high_energy"]/div[1]/div[2]/div')  for i in c:    #这里一定要注意,在selenium中不能像xpath那样写('./a/@href')来获取指定的位置,要报错,只能这么获取,查了很久    detail_url = i.find_element_by_xpath('./a').get_attribute('href')    name = i.find_element_by_xpath('./a/p').get_attribute('title')    detail_page_text = requests.get(url=detail_url,headers = headers).text    print(detail_url,name)#运行完事get_webhot()

这是这个结果

在这里插入图片描述

到此这篇关于selenium与xpath之获取指定位置的元素的实现的文章就介绍到这了,更多相关selenium与xpath指定位置元素内容请搜索51zixue.net以前的文章或继续浏览下面的相关文章希望大家以后多多支持51zixue.net!


详解Python中的Lock和Rlock
详解用selenium来下载小姐姐图片并保存
万事OK自学网:51自学网_软件自学网_CAD自学网自学excel、自学PS、自学CAD、自学C语言、自学css3实例,是一个通过网络自主学习工作技能的自学平台,网友喜欢的软件自学网站。