selenium进行xhs图片爬虫:03获取一篇图文的图片
在使用Selenium进行图片爬虫时,首先需要定位到包含图片的元素,然后获取元素的属性来获取图片的URL。以下是一个简单的例子,假设我们要获取一篇包含图片的网页中的所有图片链接:
from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
import time
# 启动浏览器
driver = webdriver.Chrome()
# 打开网页
driver.get('http://example.com/article-with-images')
# 等待页面加载完成
wait = WebDriverWait(driver, 10)
# 获取文章中的所有图片元素
images = wait.until(EC.presence_of_all_elements_located((By.TAG_NAME, 'img')))
# 循环遍历图片元素,获取图片链接
for img in images:
src = img.get_attribute('src')
print(src)
# 关闭浏览器
time.sleep(5) # 等待5秒,以便于查看结果
driver.quit()
请确保在运行此代码之前已经安装了Selenium库和相应的WebDriver(如ChromeDriver),并且已经正确配置了路径。此代码会打开指定的网页,加载所有的图片元素,并打印出它们的src
属性,即图片链接。
评论已关闭