99 votes

Comment faire fonctionner les requêtes python via un proxy socks ?

J'utilise le grand Demandes dans mon script Python :

import requests
r = requests.get("some-site.com")
print r.text

Je voudrais utiliser le proxy socks. Mais Requests ne prend en charge que le proxy HTTP pour le moment.

Comment puis-je faire ça ?

5voto

Vous pouvez simplement exécuter votre script avec https_proxy variable d'environnement.

  1. Installez le support de chaussettes si nécessaire.

    pip install PySocks pip install pysocks5

  2. Variable d'environnement de configuration

    export https_proxy=socks5://<hostname or ip>:<port>

  3. Exécutez votre script. Cet exemple fait une demande en utilisant un proxy et montre l'adresse IP :

    echo Your real IP python -c 'import requests;print(requests.get("http://ipinfo.io/ip").text)'

    echo IP with socks-proxy python -c 'import requests;print(requests.get("https://ipinfo.io/ip").text)'

3voto

wcc526 Points 153
# SOCKS5 proxy for HTTP/HTTPS
proxiesDict = {
    'http' : "socks5://1.2.3.4:1080",
    'https' : "socks5://1.2.3.4:1080"
}

# SOCKS4 proxy for HTTP/HTTPS
proxiesDict = {
    'http' : "socks4://1.2.3.4:1080",
    'https' : "socks4://1.2.3.4:1080"
}

# HTTP proxy for HTTP/HTTPS
proxiesDict = {
    'http' : "1.2.3.4:1080",
    'https' : "1.2.3.4:1080"
}

2voto

Edward Betts Points 354

J'ai installé pysocks et monkey a patché create_connection dans urllib3, comme ceci :

import socks
import socket
socks.setdefaultproxy(socks.PROXY_TYPE_SOCKS4, "127.0.0.1", 1080)

def create_connection(address, timeout=socket._GLOBAL_DEFAULT_TIMEOUT,
                      source_address=None, socket_options=None):
    """Connect to *address* and return the socket object.

    Convenience function.  Connect to *address* (a 2-tuple ``(host,
    port)``) and return the socket object.  Passing the optional
    *timeout* parameter will set the timeout on the socket instance
    before attempting to connect.  If no *timeout* is supplied, the
    global default timeout setting returned by :func:`getdefaulttimeout`
    is used.  If *source_address* is set it must be a tuple of (host, port)
    for the socket to bind as a source address before making the connection.
    An host of '' or port 0 tells the OS to use the default.
    """

    host, port = address
    if host.startswith('['):
        host = host.strip('[]')
    err = None
    for res in socket.getaddrinfo(host, port, 0, socket.SOCK_STREAM):
        af, socktype, proto, canonname, sa = res
        sock = None
        try:
            sock = socks.socksocket(af, socktype, proto)

            # If provided, set socket level options before connecting.
            # This is the only addition urllib3 makes to this function.
            urllib3.util.connection._set_socket_options(sock, socket_options)

            if timeout is not socket._GLOBAL_DEFAULT_TIMEOUT:
                sock.settimeout(timeout)
            if source_address:
                sock.bind(source_address)
            sock.connect(sa)
            return sock

        except socket.error as e:
            err = e
            if sock is not None:
                sock.close()
                sock = None

    if err is not None:
        raise err

    raise socket.error("getaddrinfo returns an empty list")

# monkeypatch
urllib3.util.connection.create_connection = create_connection

2voto

Nizam Mohamed Points 2921

Je pourrais faire ça sous Linux.

$ pip3 install --user 'requests[socks]'
$ https_proxy=socks5://<hostname or ip>:<port> python3 -c \
> 'import requests;print(requests.get("https://httpbin.org/ip").text)'

Prograide.com

Prograide est une communauté de développeurs qui cherche à élargir la connaissance de la programmation au-delà de l'anglais.
Pour cela nous avons les plus grands doutes résolus en français et vous pouvez aussi poser vos propres questions ou résoudre celles des autres.

Powered by:

X