Free Proxy Health List

Ảnh chụp trực tiếp · 55,863 proxies

Proxy miễn phí cho web scraping

Xoay địa chỉ IP trong suốt quá trình thu thập để một địa chỉ không gánh toàn bộ yêu cầu và chạm giới hạn tần suất.

Proxy miễn phí cho web scraping

1. Tải danh sách

curl -sL https://raw.githubusercontent.com/xyzs996/free-proxy-health-list/main/all.txt -o proxies.txt

2. Nạp và xoay vòng

import itertools, requests

proxies = [line.strip() for line in open("proxies.txt") if line.strip()]
pool = itertools.cycle(proxies)

def fetch(url):
    for _ in range(10):
        proxy = next(pool)
        try:
            return requests.get(
                url,
                proxies={"http": f"http://{proxy}", "https": f"http://{proxy}"},
                timeout=8,
            )
        except requests.RequestException:
            continue
    raise RuntimeError("no working proxy")

Vài lưu ý giúp tiết kiệm thời gian

Proxy miễn phí vốn hay hỏng, nên vòng lặp ở trên mới là phần quan trọng: luôn thử mục kế tiếp thay vì coi một lần thất bại là chí mạng. Đặt thời gian chờ ngắn — một proxy đã chết ngốn trọn thời gian chờ ở mỗi yêu cầu — và tải lại danh sách theo nhịp phát hành để không xoay mãi những mục đã hết hạn từ nhiều giờ trước. Hãy tôn trọng robots.txt và điều khoản của trang đích; xoay vòng là để phân tán tải, không phải để né kiểm soát truy cập.

Hướng dẫn liên quan

Giới hạn của ảnh chụp công khai
Proxy công khai miễn phí được dùng chung và vận hành bởi các bên không rõ danh tính. Đừng bao giờ gửi mật khẩu, token hay dữ liệu cá nhân qua chúng. Hãy tuân thủ Chính sách Sử dụng Chấp nhận được của GitHub: không spam, không tấn công, không vượt kiểm soát truy cập, không thu thập trái chính sách của trang.