selenium进行xhs图片爬虫：03获取一篇图文的图片

作者：System 时间：2024年08月16日分类：所有,爬虫字数：828

这篇文章距离上次修改已过696天，其中的内容可能已经有所变动。

在使用Selenium进行图片爬虫时，首先需要定位到包含图片的元素，然后获取元素的属性来获取图片的URL。以下是一个简单的例子，假设我们要获取一篇包含图片的网页中的所有图片链接：




from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
import time
 
# 启动浏览器
driver = webdriver.Chrome()
 
# 打开网页
driver.get('http://example.com/article-with-images')
 
# 等待页面加载完成
wait = WebDriverWait(driver, 10)
 
# 获取文章中的所有图片元素
images = wait.until(EC.presence_of_all_elements_located((By.TAG_NAME, 'img')))
 
# 循环遍历图片元素，获取图片链接
for img in images:
    src = img.get_attribute('src')
    print(src)
 
# 关闭浏览器
time.sleep(5)  # 等待5秒，以便于查看结果
driver.quit()

请确保在运行此代码之前已经安装了Selenium库和相应的WebDriver（如ChromeDriver），并且已经正确配置了路径。此代码会打开指定的网页，加载所有的图片元素，并打印出它们的src属性，即图片链接。

selenium进行xhs图片爬虫：03获取一篇图文的图片

评论已关闭

推荐阅读