
1. Tải danh sách
curl -sL https://raw.githubusercontent.com/xyzs996/free-proxy-health-list/main/all.txt -o proxies.txt2. Nạp và xoay vòng
import itertools, requests
proxies = [line.strip() for line in open("proxies.txt") if line.strip()]
pool = itertools.cycle(proxies)
def fetch(url):
for _ in range(10):
proxy = next(pool)
try:
return requests.get(
url,
proxies={"http": f"http://{proxy}", "https": f"http://{proxy}"},
timeout=8,
)
except requests.RequestException:
continue
raise RuntimeError("no working proxy")Vài lưu ý giúp tiết kiệm thời gian
Proxy miễn phí vốn hay hỏng, nên vòng lặp ở trên mới là phần quan trọng: luôn thử mục kế tiếp thay vì coi một lần thất bại là chí mạng. Đặt thời gian chờ ngắn — một proxy đã chết ngốn trọn thời gian chờ ở mỗi yêu cầu — và tải lại danh sách theo nhịp phát hành để không xoay mãi những mục đã hết hạn từ nhiều giờ trước. Hãy tôn trọng robots.txt và điều khoản của trang đích; xoay vòng là để phân tán tải, không phải để né kiểm soát truy cập.
Hướng dẫn liên quan
Giới hạn của ảnh chụp công khai
Proxy công khai miễn phí được dùng chung và vận hành bởi các bên không rõ danh tính. Đừng bao giờ gửi mật khẩu, token hay dữ liệu cá nhân qua chúng. Hãy tuân thủ Chính sách Sử dụng Chấp nhận được của GitHub: không spam, không tấn công, không vượt kiểm soát truy cập, không thu thập trái chính sách của trang.
Proxy công khai miễn phí được dùng chung và vận hành bởi các bên không rõ danh tính. Đừng bao giờ gửi mật khẩu, token hay dữ liệu cá nhân qua chúng. Hãy tuân thủ Chính sách Sử dụng Chấp nhận được của GitHub: không spam, không tấn công, không vượt kiểm soát truy cập, không thu thập trái chính sách của trang.