Pythonで画像を一括でスクレイピングして保存する方法は何ですか?
Pythonで、requestsやBeautifulSoupなどのサードパーティーライブラリを使用して、画像を一括でクロールして保存することができます。
最初に、適切なサードパーティーライブラリをインストールする必要があります。以下のコマンドを使用してインストールできます:
pip install requests
pip install beautifulsoup4
以下是一个简单的示例代码,用于大量抓取并保存图片:
import requests
from bs4 import BeautifulSoup
import os
# 定义要爬取的网页链接
url = "http://example.com"
# 发送GET请求,获取网页内容
response = requests.get(url)
# 使用BeautifulSoup解析网页内容
soup = BeautifulSoup(response.text, "html.parser")
# 查找所有的图片标签
img_tags = soup.find_all("img")
# 创建保存图片的文件夹
if not os.path.exists("images"):
os.makedirs("images")
# 遍历找到的图片标签
for img in img_tags:
# 获取图片链接
img_url = img["src"]
# 发送GET请求,获取图片内容
img_response = requests.get(img_url)
# 提取图片名称
img_name = img_url.split("/")[-1]
# 保存图片到本地文件夹
with open("images/" + img_name, "wb") as f:
f.write(img_response.content)
print("已保存图片:" + img_name)
このコードは、現在のディレクトリに名前が「images」のフォルダを作成し、収集した画像をそのフォルダに保存します。
このコードは、単純な静的ウェブページにしか適用されません。ログインや他の方法でアクセスが必要なウェブページには、追加の処理が必要です。