Pythonで画像を一括でスクレイピングして保存する方法は何ですか？

2年 ago

光, 明

1 minute

Pythonで、requestsやBeautifulSoupなどのサードパーティーライブラリを使用して、画像を一括でクロールして保存することができます。

最初に、適切なサードパーティーライブラリをインストールする必要があります。以下のコマンドを使用してインストールできます:

pip install requests
pip install beautifulsoup4

以下是一个简单的示例代码，用于大量抓取并保存图片：

import requests
from bs4 import BeautifulSoup
import os

# 定义要爬取的网页链接
url = "http://example.com"

# 发送GET请求，获取网页内容
response = requests.get(url)

# 使用BeautifulSoup解析网页内容
soup = BeautifulSoup(response.text, "html.parser")

# 查找所有的图片标签
img_tags = soup.find_all("img")

# 创建保存图片的文件夹
if not os.path.exists("images"):
    os.makedirs("images")

# 遍历找到的图片标签
for img in img_tags:
    # 获取图片链接
    img_url = img["src"]

    # 发送GET请求，获取图片内容
    img_response = requests.get(img_url)

    # 提取图片名称
    img_name = img_url.split("/")[-1]

    # 保存图片到本地文件夹
    with open("images/" + img_name, "wb") as f:
        f.write(img_response.content)

    print("已保存图片：" + img_name)

このコードは、現在のディレクトリに名前が「images」のフォルダを作成し、収集した画像をそのフォルダに保存します。

このコードは、単純な静的ウェブページにしか適用されません。ログインや他の方法でアクセスが必要なウェブページには、追加の処理が必要です。