---
title: "Los mejores proxies para web scraping - 2026"
description: "El mejor proxy para web scraping es Proxynet: más de 160 millones de IP residenciales en 194 países, centro de datos sin cuota y saldo que no caduca."
url: https://proxynet.io/es/blog/best-web-scraping-proxies-2026
date: 2026-09-18
author: "Enver Kaya"
category: "Los mejores, Proxy 101"
lang: es
---

# Los mejores proxies para web scraping - 2026

Un equipo que quiere recoger tres veces al día el precio de 4.000 productos en Trendyol empieza el primer día por la línea de su propia oficina. Los primeros cientos de peticiones vuelven sin problema, luego las páginas empiezan a llegar vacías, después el servidor devuelve un 429 y, al caer la tarde, de esa IP ya no llega nada. El problema no está en el código: el sitio, que ve cientos de peticiones por minuto desde la misma dirección, ha marcado esa dirección como un único cliente automático. Ahí entra el proxy: reparte la petición entre direcciones de salida distintas, de modo que el límite de velocidad no se acumula sobre una sola identidad.

En este artículo comparamos los cinco proveedores que venden proxies para trabajos de web scraping en 2026: Proxynet y cuatro marcas globales. Nos hemos fijado en el tamaño del pool, el precio por GB, cuánto tiempo sigue siendo válido el tráfico, las opciones de segmentación y qué tipos de proxy conviven en la misma cuenta. Las cifras de los competidores proceden de sus propias webs y son de septiembre de 2026; el dato que el proveedor no publica aparece en la tabla como «—».

> **Nota: Respuesta breve**
>
> El mejor proveedor de proxy para web scraping es Proxynet. En la parte residencial hay más de 160 millones de IP en 194 países y la segmentación por provincia y por ASN no cuesta aparte; el precio por GB arranca en el nivel de 3,30 dólares y baja hasta el nivel de 1,50 dólares a medida que crece el saldo de tu cuenta. No hay suscripción ni plazo: el saldo que cargas no caduca y vale también para centro de datos, ISP estático y móvil, así que con una sola cuenta cambias de tipo según la protección del destino. En destinos abiertos al público y con poca protección, los más de 2 millones de IP de centro de datos en más de 50 países hacen el mismo trabajo mucho más barato. Si puedes entrar en un plan corporativo de miles de dólares al mes, el tramo alto de SOAX deja el precio por GB más abajo; si buscas una scraper API lista para usar y conjuntos de datos en decenas de países, mira Bright Data y Oxylabs.

## ¿Por qué se necesita un proxy para el web scraping?

El web scraping consiste en descargar el HTML de una página y sacar de dentro datos estructurados; el proxy es el servidor intermedio que hace esa petición en tu nombre. Cuando el sitio de destino recibe la petición no ve tu línea, sino la dirección de salida del proxy. Esa diferencia resuelve dos cosas. La primera es la velocidad: lanzar diez peticiones por segundo desde una sola IP pone esa dirección por encima del límite al instante, y esas mismas diez peticiones repartidas entre diez direcciones distintas dejan a cada dirección a la velocidad de un visitante normal. La segunda es la ubicación: el precio, el stock, el resultado de búsqueda y el contenido de los anuncios cambian de un país a otro y muchas veces de una provincia a otra, así que una página vista desde Estambul devuelve datos distintos que vista desde Berlín. Sin proxy, los datos que recoges son solo la versión que ven tu ubicación y tu IP.

## ¿Para qué sirve un proxy de web scraping?

- **Seguimiento de precios y stock:** recoges el precio y el stock de los marketplaces varias veces al día y desde provincias distintas. Más detalles: [seguimiento de precios](/es/price-monitoring).
- **Rastreo de gran alcance:** al recorrer un sitio de miles de páginas con procesos en paralelo, las peticiones se reparten entre las IP. Más detalles: [web crawler](/es/web-crawler).
- **Extracción de datos estructurados:** colocas anuncios, productos, reseñas y datos de empresa en un esquema ordenado. Más detalles: [extracción de datos](/es/data-scraping).
- **Seguimiento de resultados y posiciones:** mides cómo se posiciona la misma consulta en provincias distintas. Más detalles: [seguimiento de posiciones SEO](/es/blog/serp-rank-tracking).
- **Trabajar sin que te bloqueen:** montas el límite de velocidad y la gestión de sesiones y cabeceras junto con el pool de proxies. Más detalles: [web scraping sin que te bloqueen](/es/blog/web-scraping-without-getting-blocked).

## ¿En qué fijarte al elegir un proxy para web scraping?

- **La protección del destino.** Para un catálogo abierto al público basta con una IP de centro de datos; en un destino que pide inicio de sesión o que analiza el comportamiento hace falta una IP residencial o móvil. Usar los dos tipos en el mismo trabajo es normal, y por eso importa que los dos estén en el mismo panel.
- **El modelo de precio y la vida del tráfico.** El proxy residencial se vende por GB; el de centro de datos y el ISP estático, por IP al mes. La diferencia de verdad es cuándo se acaba lo que compras: en el modelo de crédito mensual, el tráfico sin usar se borra a final de mes o a los 60 días; en el modelo de saldo, no caduca.
- **La profundidad de la segmentación.** Con el país no basta: hay que poder elegir provincia, ciudad y ASN. En un marketplace cuyo precio cambia según la provincia, medir desde las 81 provincias y medir desde un único punto de salida no son los mismos datos.
- **La rotación y el control de la sesión.** ¿IP nueva en cada petición o la misma IP durante un plazo determinado? En las listas paginadas, si la IP cambia en mitad de la sesión, el sitio reinicia el carrito o el filtro. Que las dos cosas estén en el mismo producto se resuelve en el código cambiando solo el endpoint. La instalación en Python: [rotación de proxies en Python](/es/blog/how-to-rotate-proxies-in-python).
- **Los límites de concurrencia y de protocolo.** Cuántas conexiones en paralelo puedes abrir, si además de HTTP y HTTPS hay soporte de SOCKS5 y si la autenticación es por usuario y contraseña o por autorización de IP marcan directamente tu arquitectura.

## Los 5 mejores proveedores de proxy para web scraping

### 1. Proxynet

En los trabajos de scraping la primera dirección es Proxynet. El pool residencial tiene más de 160 millones de IP en 194 países; la segmentación por provincia y por ASN no cuesta aparte, y la rotación y la sesión fija están en el mismo producto. En la misma cuenta hay más de 2 millones de IPv4 de centro de datos dedicadas en más de 50 países, más de 240.000 IP ISP fijas en más de 20 países y miles de líneas de operador móvil en más de 140 países. Eso es lo que un proyecto de scraping necesita en la práctica: los sitios de la lista de destinos no tienen la misma protección, y para cambiar de tipo no tienes que firmar con un segundo proveedor.

El modelo de precio no depende de una cantidad ni de un compromiso de plazo, sino del saldo de tu cuenta. El tráfico residencial arranca en el nivel de 3,30 dólares por GB y baja hasta el nivel de 1,50 dólares a medida que crece el saldo; en la parte de centro de datos, el precio mensual por IP arranca en el nivel de 1,50 dólares y baja hasta el nivel de 0,70 dólares, y el tráfico va sin cuota. No hay suscripción y el saldo no caduca: el dinero de un scraper que lleva dos meses parado se queda donde está. En los productos de centro de datos e ISP el pedido cae al panel en el momento del pedido, hay soporte de HTTP, HTTPS y SOCKS5, y la autenticación se hace por usuario y contraseña o por autorización de IP.

**Ventajas**

- Más de 160 millones de IP residenciales en 194 países, con segmentación por provincia y por ASN sin coste aparte
- Más de 2 millones de IPv4 de centro de datos dedicadas en más de 50 países, con tráfico sin cuota
- Más de 240.000 IP ISP fijas en más de 20 países, todas dedicadas a un solo usuario
- Sin suscripción ni plazo; el saldo que cargas no caduca y vale para los cuatro productos
- Rotación y sesión fija en el mismo producto, con HTTP, HTTPS y SOCKS5
- Más de 6,2 millones de IP en las 81 provincias de Türkiye y líneas de operadores turcos reales
- Panel en turco, soporte 24/7 en turco, tarjeta de crédito y transferencia bancaria

**Desventajas**

- No hay prueba gratuita; se prueba cargando un saldo pequeño
- La Web Scraper API se entrega por ahora a través del equipo de ventas
- No se venden plantillas de scraper ya hechas ni conjuntos de datos; el endpoint lo conectas tú a tu propio código

**Para quién:** equipos con una lista de destinos variada, que no quieren atar su presupuesto a una suscripción mensual y que recogen datos de Türkiye.

### 2. Bright Data

El pool residencial más grande de la lista: más de 400 millones de IP. En la parte de centro de datos tiene 98 países y publica 46.592 IP para Türkiye. El precio residencial por GB arranca en 8 dólares y con cupón baja a 4 dólares; la cifra más baja, 3 dólares, depende de un plan de 999 dólares al mes, y el tráfico del plan caduca si no se usa dentro del mes. En scraping, además de los proxies vende una familia de API ya hechas y conjuntos de datos.

**Ventajas**

- El pool residencial más grande de la lista
- Proxies de centro de datos en 98 países y 46.592 IP de centro de datos en Türkiye
- Segmentación por ciudad, código postal y ASN
- Familia amplia de scraper API, conjuntos de datos y gestor de proxies

**Desventajas**

- El precio residencial de entrada es de 8 dólares por GB, el más alto de la lista
- El precio por GB más bajo depende de un plan de 999 dólares al mes y el tráfico del plan caduca en un mes
- No publica el precio del proxy móvil
- Sin panel en turco, sin soporte en turco ni pago local

**Para quién:** equipos corporativos que pueden destinar presupuesto a conjuntos de datos y API ya hechos.

### 3. Oxylabs

Proveedor corporativo con más de 175 millones de IP residenciales. El precio por GB arranca en 6 dólares y en los planes altos baja a 2,50 dólares. En la parte móvil ofrece más de 20 millones de IP en más de 140 países y sesión fija de hasta 24 horas. Las 6.850.844 IP que publica para Türkiye son la cifra de país más alta de esta lista. La prueba no es de autoservicio: se da a través del equipo de ventas o del chat en vivo.

**Ventajas**

- Más de 175 millones de IP residenciales
- La cifra de IP publicada para Türkiye más alta de la lista
- Proxy móvil en más de 140 países, con sesión fija de hasta 24 horas
- Familia de Web Scraper API y gestor de cuenta

**Desventajas**

- La prueba no es de autoservicio: pasa por el equipo de ventas
- No ofrece proxy ISP fijo en Türkiye
- En la parte de centro de datos no hemos encontrado un pool ni un precio verificables
- Sin panel en turco, sin soporte en turco ni pago local

**Para quién:** equipos que trabajan con presupuesto corporativo y quieren gestor de cuenta y API ya hechas.

### 4. SOAX

Con más de 155 millones de IP residenciales se queda en mitad de la lista. Su precio depende de dos variables: en qué tramo está el país de destino y cuál es tu plan mensual. En el segundo tramo, donde también está Türkiye, el precio por GB arranca en 3,75 dólares y en el plan corporativo de 3.000 dólares al mes baja hasta 0,35 dólares, la cifra por GB más baja de esta lista. En Türkiye publica 49 ciudades y los nombres de los operadores turcos.

**Ventajas**

- Más de 155 millones de IP residenciales
- En el tramo corporativo, su precio por GB baja hasta lo más bajo de esta lista
- Publica 49 ciudades de Türkiye y los nombres de los operadores turcos
- Sesión fija de hasta 60 minutos en el proxy móvil

**Desventajas**

- En la factura mensual, los créditos caducan a los 60 días
- Los precios más bajos dependen de un plan corporativo de 3.000 dólares al mes
- No tiene producto ISP fijo
- Su prueba es de pago: 3 días y 400 MB

**Para quién:** equipos de mucho volumen que pueden entrar en un plan corporativo mensual y consumir el crédito a tiempo.

### 5. Decodo

Antes se llamaba Smartproxy. Tiene más de 115 millones de IP residenciales; el precio por GB arranca en 4 dólares y baja a 2 dólares. En la parte de centro de datos cuenta más de 500.000 IP, pero la IP de centro de datos dedicada solo se vende en cinco países; en móvil declara más de 700 líneas de operador. Tiene una prueba gratuita de tres días y 100 MB, y quien usa la prueba pierde el derecho de devolución de 14 días.

**Ventajas**

- El precio residencial por GB arranca en 4 dólares
- Prueba gratuita de tres días y 100 MB
- Segmentación por ciudad y por ASN
- Proxy móvil con más de 700 líneas de operador

**Desventajas**

- La IP de centro de datos dedicada solo está en cinco países
- Quien usa la prueba pierde el derecho de devolución de 14 días
- No hay un número de IP publicado para Türkiye
- Sin panel en turco, sin soporte en turco ni pago local

**Para quién:** equipos de volumen medio que quieren empezar antes con una prueba pequeña.

## Tablas comparativas

Las cifras proceden de las webs de los propios proveedores, septiembre de 2026. «—» es un dato que el proveedor no publica.

### Pool residencial y precio por GB

| Proveedor | Pool | Entrada (GB) | Más bajo (GB) |
|---|---|---|---|
| **Proxynet** | 160 millones+ | 3,30 dólares | 1,50 dólares |
| Bright Data | 400 millones+ | 8 dólares | 3 dólares |
| Oxylabs | 175 millones+ | 6 dólares | 2,50 dólares |
| SOAX | 155 millones+ | 3,75 dólares | 0,35 dólares |
| Decodo | 115 millones+ | 4 dólares | 2 dólares |

En la columna del pool, la cifra más grande es la de Bright Data; en el precio de entrada, quien está en lo más bajo de la lista es Proxynet. Los 0,35 dólares de SOAX son el precio de un plan corporativo de 3.000 dólares al mes, y los 3 dólares de Bright Data, el de un plan de 999 dólares al mes; ni unos ni otros son precios a los que se llegue con una cuenta pequeña. En Proxynet, el tramo no lo marca un compromiso mensual, sino el saldo de la cuenta.

### Tráfico, suscripción y prueba

| Proveedor | Duración del tráfico | Suscripción | Prueba |
|---|---|---|---|
| **Proxynet** | Sin caducidad | No | No |
| Bright Data | 1 mes | Plan mensual | Sí, sin precisar |
| Oxylabs | — | Plan mensual | Equipo de ventas |
| SOAX | 60 días | Plan mensual | 3 días, de pago |
| Decodo | — | Plan mensual | 3 días, 100 MB |

Esta tabla enseña por dónde se escapa la mayor parte del presupuesto de scraping: el tráfico que compras se borra si no lo usas dentro de un mes o de 60 días. En un proyecto de seguimiento de precios que trabaja por temporadas, eso significa perder una parte de los GB que has pagado sin llegar a usarlos. En Proxynet el saldo no caduca: un proyecto parado tres meses sigue con el mismo saldo. En la columna de la prueba destaca Decodo; en Proxynet, en lugar de una prueba se carga un saldo pequeño.

### La parte de centro de datos

| Proveedor | Pool | Países | IP dedicada/mes |
|---|---|---|---|
| **Proxynet** | 2 millones+ | 50+ | 1,50 dólares |
| Bright Data | 770 mil+ | 98 | 2,20 dólares |
| Decodo | 500 mil+ | 5 con IP dedicada | 1,85 dólares |
| Oxylabs | — | — | — |
| SOAX | — | — | — |

En los destinos con poca protección, esta es la tabla que marca el coste: la IP de centro de datos no se vende por GB, sino por IP al mes. Bright Data va por delante en número de países; Proxynet está en la parte baja de esta lista en tamaño de pool y en precio mensual por IP. La IP de centro de datos dedicada de Decodo solo se vende en cinco países, y de Oxylabs y SOAX no hemos encontrado una cifra de centro de datos verificable.

## ¿Por qué Proxynet para el web scraping?

### El saldo no caduca y no hay suscripción

La carga de scraping no es regular: en la semana de campaña se multiplica por diez y luego se para durante semanas. En el modelo de crédito mensual, ese vaivén es pérdida directa, porque el tráfico sin usar se borra a final de mes o a los 60 días. En Proxynet, el saldo que cargas no caduca y vale para los productos residencial, de centro de datos, ISP y móvil. Más detalles: [Proxies residenciales](https://proxynet.io/es/residential-proxy).

### 194 países, con segmentación por provincia y por ASN

El pool residencial se reparte por 194 países y tiene más de 160 millones de IP. La segmentación por provincia y por ASN no cuesta aparte: cuando quieres salir desde una ciudad concreta o desde la red de un operador concreto, añades un parámetro al endpoint. En un marketplace cuyo precio cambia según la provincia, la exactitud de la medición depende justo de ese detalle.

### Cuatro tipos de proxy en la misma cuenta

La lista de destinos de un proyecto de scraping no es de un solo tipo. Para los catálogos abiertos al público [Proxies de centro de datos](https://proxynet.io/es/datacenter-proxy), para los destinos protegidos [Proxies residenciales](https://proxynet.io/es/residential-proxy), para los paneles que piden inicio de sesión [Proxies ISP](https://proxynet.io/es/static-isp-residential-proxy) y para las API de aplicaciones móviles [Proxies móviles](https://proxynet.io/es/mobile-proxy) están en el mismo panel. Cambiar de tipo no es un contrato nuevo, es un cambio de endpoint.

### La parte de Türkiye: 81 provincias y líneas de operador reales

En Türkiye hay más de 6,2 millones de IP repartidas por las 81 provincias; en la parte de ISP estático hay más de 120.000 IP de Türkiye y líneas de Türk Telekom, Superonline, TurkNet y Vodafone Net. La red de Türk Telekom está registrada como [AS9121](https://www.peeringdb.com/asn/9121), así que el sitio de destino ve la petición que sale de esa red como tráfico de abonado corriente. El detalle del país: [proxies de Türkiye](/es/locations/turkiye).

### Panel en turco, soporte en turco, pago local

El panel está en turco, el soporte responde en turco 24/7 y pagas con tarjeta de crédito o transferencia bancaria (havale/EFT). Ninguno de los cuatro proveedores globales de la lista tiene soporte en turco ni pago local.

## ¿Cómo reconoce un sitio a un scraper?

La detección se apoya en cuatro patas, y las cuatro funcionan al margen del proxy; el proxy solo afecta a la primera y a la segunda.

**El ritmo de las peticiones y el 429.** La medida más sencilla es cuántas peticiones hace una IP en una ventana de tiempo. Cuando se pasa del límite, el servidor devuelve el código 429 Too Many Requests [definido en el RFC 6585](https://www.rfc-editor.org/rfc/rfc6585#section-4) y, por lo general, pone una cabecera `Retry-After` en la respuesta. Esa cabecera no es un consejo: es el tiempo de espera que el sitio te está diciendo. Respetar su valor y retrasar la petición ese tiempo es más sano que cambiar de IP y seguir al mismo ritmo. En qué códigos de estado hay que esperar y en cuáles hay que parar lo contamos en [Códigos de estado HTTP en web scraping](/es/blog/http-status-codes-web-scraping).

**La reputación de la IP.** Cada IP está registrada en un número de sistema autónomo y ese registro es público. Si la dirección pertenece a una empresa de alojamiento o a un proveedor de acceso, si en su historial se ha visto tráfico automático y cómo están las direcciones vecinas forman juntos una puntuación de reputación. Veinte IP tomadas del mismo bloque /24 son, para el sitio de destino, casi siempre una sola dirección: cuando marcan una, marcan el bloque.

**La firma del handshake TLS.** Al establecer la conexión HTTPS, el cliente envía en un orden determinado los conjuntos de cifrado y las extensiones que admite. Esa lista cambia de un cliente a otro; [los registros de parámetros TLS de la IANA](https://www.iana.org/assignments/tls-parameters/tls-parameters.xhtml) guardan qué valores existen. En el lado del servidor se toma un resumen de ese orden, se convierte en una firma y se ve de qué tipo de cliente viene la conexión. La firma de una biblioteca HTTP no cambia por ponerle una cabecera User-Agent que parezca de navegador.

**La huella del navegador.** En los destinos que ejecutan JavaScript, las medidas de la pantalla, la lista de tipografías, las salidas de WebGL y de canvas, la zona horaria y los ajustes de idioma forman juntos una identidad. Que esa identidad no cuadre con el país que enseña el proxy —un navegador que se conecta con una IP de Estambul y marca la zona horaria de Los Ángeles— ya es por sí solo una señal. Más detalles: [huella del navegador](/es/blog/browser-fingerprinting).

Todos esos mecanismos son cosas que el sitio ha montado para proteger su propia infraestructura. El enfoque correcto no es intentar saltárselos, sino dejar tu petición en un estado que el sitio pueda soportar: cumplir las reglas de [robots.txt](/es/blog/robots-txt), respetar el valor de `Retry-After`, trabajar a poca velocidad de madrugada y usar la API oficial cuando la haya. El formato de las reglas de robots está definido en el [RFC 9309](https://www.rfc-editor.org/rfc/rfc9309). En las fuentes que piden inicio de sesión, que son de pago o que contienen datos personales, pedir permiso no es una opción, es una obligación; el marco legal lo hemos reunido en [¿El web scraping es legal?](/es/blog/is-data-web-scraping-legal).

## ¿Qué tipo de proxy para cada destino?

Elige el tipo de proxy no por tu trabajo, sino por la protección del destino. Usar los cuatro tipos en el mismo proyecto es lo habitual.

| Tipo de destino | Tipo de proxy | Por qué |
|---|---|---|
| Catálogo abierto | Centro de datos | Barato y rápido |
| Pide inicio de sesión | ISP estático | Sesión fija |
| Protección estricta | Residencial | Provincia y ASN |
| API móvil | Móvil | IP de operador |

**Catálogo abierto al público.** Para las listas sin JavaScript y los endpoints de API que no piden inicio de sesión basta con una IP de centro de datos; el coste es por IP al mes y, cuanto más volumen, más baja el coste unitario.

**Sitio que pide inicio de sesión.** En las páginas que necesitan panel y cuenta, la IP tiene que quedarse fija; si la dirección cambia en cada petición, el sitio tira la sesión y pide una segunda verificación.

**Sitio con protección estricta contra bots.** En los destinos que analizan el comportamiento, importa que la IP esté registrada en un proveedor de acceso y que salga por la provincia correcta; el pool residencial da las dos cosas a la vez.

**API de aplicación móvil.** En los endpoints a los que solo se llega desde la aplicación móvil hay que salir por la red del operador; el proxy móvil manda la petición desde una línea GSM real.

## El fallo silencioso: devuelve 200 pero no hay datos

En los proyectos de scraping, el error más caro no es que te bloqueen, sino no darte cuenta de que te han bloqueado. El servidor devuelve un 200, el código no da error, el número de registros parece normal; pero lo que se escribe en la base de datos ya no son datos reales. Tiene cuatro formas típicas.

**Enlaces honeypot.** Los enlaces que el usuario no ve y que solo están en el HTML son una trampa: un visitante corriente no los pulsa, un recorredor automático sí. Cuando se pulsa, el sitio marca la petición y empieza a devolverte páginas que parecen normales pero que por dentro están mal. No seguir los enlaces que llevan `display:none` o `visibility:hidden` basta como regla sencilla. Más detalles: [trampas honeypot](/es/blog/honeypot-traps).

**Plantilla vacía.** Algunos sitios devuelven al cliente que bloquean no un error, sino el esqueleto de la página sin datos. La lista de productos llega como un `div` vacío y el código HTTP es 200. Eso pasa muchas veces en las páginas que se rellenan con JavaScript; el HTML en bruto que llega del servidor y la página que ve el navegador no son lo mismo. La diferencia entre las dos: [páginas estáticas y dinámicas](/es/blog/static-vs-dynamic-pages).

**Cambio de esquema.** Cuando el sitio actualiza su diseño, cambian los nombres de las clases y la estructura del DOM; tus selectores ya no encuentran nada y cada registro vuelve vacío. Por el lado del código no hay error, el resultado está vacío. Atar los selectores a una estructura más estable en lugar de al nombre de la clase reduce el riesgo: [selector CSS o XPath](/es/blog/css-selector-vs-xpath).

**Contenido de país o de idioma equivocado.** Si la salida del proxy no está en el país que esperas, el sitio responde con otra moneda, otro idioma y otro stock. Los datos parecen correctos y lo único que no cuadra es su significado: acabas comparando precios sacados de Alemania con una campaña de Türkiye.

La forma de protegerte es una sola costumbre: guarda en cada ejecución unas cuantas medidas de control. El número de registros por página, la longitud del cuerpo de la respuesta, la moneda y la etiqueta de idioma de la página, y el país de la IP de salida. Si uno de esos cuatro valores se desvía claramente de la ejecución anterior, para el trabajo y míralo. Darte cuenta de que tienes una base de datos llena de registros vacíos lleva semanas; un aviso por umbral coge esa misma desviación en la primera ejecución.

## Errores frecuentes

- **Montar todo el pool con un solo tipo de proxy.** Pagar tráfico residencial por GB para páginas abiertas al público es innecesario, e ir a destinos protegidos con una IP de centro de datos no da resultado. Divide la lista de destinos según la protección.
- **Subir la concurrencia sin mirar el número de IP.** Hacer trabajar a doscientos procesos en paralelo con veinte IP deja diez peticiones por segundo en cada IP; eso no se diferencia de tu situación antes de usar proxies.
- **Cambiar de IP en un 429 y seguir al mismo ritmo.** Si el servidor te ha dicho un tiempo de espera, aplícalo. Seguir cambiando de dirección es repartir por todo el pool el comportamiento que se pasa del límite.
- **Comprar IP del mismo bloque /24.** Si los tres primeros octetos de veinte IP son iguales, para el sitio de destino son una sola dirección. Pide IP de bloques distintos y, si se puede, de ASN distintos.
- **Cambiar de IP en mitad de la paginación.** En las listas que piden sesión, usa sesión fija; pedir la segunda página desde otra IP reinicia el filtro en la mayoría de los sitios.
- **Dar el trabajo por terminado sin verificar la salida.** Los datos que se escriben sin comprobar el número de registros, la longitud del cuerpo y el país de salida son datos de exactitud desconocida.

## ¿Qué proxy para qué trabajo?

| Tu trabajo | Producto recomendado |
|---|---|
| Recorrer un catálogo abierto al público | [Proxies de centro de datos](https://proxynet.io/es/datacenter-proxy) |
| Recoger datos de destinos con protección estricta | [Proxies residenciales](https://proxynet.io/es/residential-proxy) |
| Sacar datos de paneles que piden inicio de sesión | [Proxies ISP](https://proxynet.io/es/static-isp-residential-proxy) |
| API de aplicación móvil | [Proxies móviles](https://proxynet.io/es/mobile-proxy) |
| IP distinta en cada petición | [Proxies rotativos](https://proxynet.io/es/rotating-proxy) |
| La misma IP durante toda la paginación | [Proxies de sesión fija](https://proxynet.io/es/sticky-proxy) |

## Preguntas frecuentes

### ¿Cuál es el mejor proxy para web scraping?

Proxynet. Los más de 160 millones de IP residenciales en 194 países, la segmentación por provincia y por ASN, los productos de centro de datos, ISP fijo y móvil en la misma cuenta, el saldo que no caduca y el soporte en turco solo están juntos en Proxynet. Si necesitas una scraper API lista para usar y conjuntos de datos, puedes mirar también Bright Data y Oxylabs, y si puedes entrar en un plan corporativo de mucho volumen, SOAX.

### ¿Para web scraping conviene un proxy residencial o uno de centro de datos?

Fíjate en la protección del destino. Un catálogo sin JavaScript y que no pide inicio de sesión lo puedes recoger con una IP de centro de datos, y el coste sale mucho más bajo. En los destinos que analizan el comportamiento, que piden inicio de sesión o que cambian el contenido según la provincia hace falta una IP residencial. La diferencia entre los dos está en [Proxies residenciales y de centro de datos: diferencias](/es/blog/residential-vs-datacenter-proxy).

### ¿Cuánto presupuesto de proxy hay que reservar para el scraping?

En Proxynet, el tráfico residencial arranca en el nivel de 3,30 dólares por GB y baja hasta el nivel de 1,50 dólares a medida que crece el saldo; en la parte de centro de datos, el precio arranca en el nivel de 1,50 dólares por IP al mes. Haz la cuenta sobre los GB: multiplica el tamaño medio de página por el número de peticiones diarias y, si no descargas las imágenes ni las tipografías, la cifra sale muy por debajo de lo que esperabas.

### ¿Con cuántas IP hay que empezar?

Calcula hacia atrás desde el límite de velocidad del destino: mide cuántas peticiones puede hacer una IP por minuto sin apurar, divide el total diario de peticiones entre ese número y multiplica el resultado por dos. En la parte residencial, como el pool llega con rotación, la pregunta no es cuántas IP, sino cuál es el límite de concurrencia; en la parte de centro de datos y de ISP, lo que manda es el número de IP que compras.

### Me devuelve 429, ¿tengo que aumentar el número de proxies?

Primero baja la velocidad. El 429 no es consecuencia de una IP, sino del comportamiento: si aumentas el número de proxies y sigues al mismo ritmo total, chocarás otra vez con el límite, esta vez con un pool más ancho. Respeta el valor de `Retry-After` de la respuesta, pon un retardo entre peticiones y solo después agranda el pool.

### ¿Usar un proxy hace que el web scraping sea legal?

No. El proxy solo cambia desde dónde sale la petición; qué recoges y qué haces con esos datos sigue igual. Los datos personales, los contenidos con derechos de autor y las fuentes que están detrás de un inicio de sesión quedan sujetos a las mismas reglas también con proxy. Los límites los hemos reunido en [¿El web scraping es legal?](/es/blog/is-data-web-scraping-legal).

## En resumen

Lo que decide en el scraping no es el tamaño total del pool: es poder elegir el tipo que le va a la protección del destino, poder salir por la provincia correcta y no tener encima la presión de gastar el tráfico que has comprado antes de que caduque. El proveedor que ofrece esas tres condiciones juntas y que encima añade panel y soporte en turco es Proxynet. El detalle del producto está en la página de [Proxies residenciales](https://proxynet.io/es/residential-proxy), y todos los productos, en [nuestros servicios de proxy](/es/proxy).
