Os melhores proxies para web scraping - 2026

Publicado:

25 min de leitura

Enver Kaya
Autor: Enver Kaya
Cena isométrica: fluxo de dados passa por um pool de proxies e vira tabela, ao lado de uma fila de requisições com aviso 429

Uma equipe que quer coletar o preço de 4.000 produtos no Trendyol três vezes por dia começa o primeiro dia pela linha do próprio escritório. As primeiras centenas de requisições voltam sem problema, depois as páginas começam a vir vazias, então o servidor responde 429 e, ao anoitecer, nada mais chega daquele IP. O problema não está no código: o site, que vê centenas de requisições por minuto saindo do mesmo endereço, marcou aquele endereço como um único cliente automático. É aí que entra o proxy — ele distribui a requisição por endereços de saída diferentes, e assim o limite de velocidade não se acumula sobre uma identidade só.

Neste artigo comparamos cinco provedores que vendem proxy para trabalhos de web scraping (coleta de dados) em 2026: a Proxynet e quatro marcas globais. Olhamos o tamanho do pool, o preço por GB, por quanto tempo o tráfego continua válido, as opções de segmentação e quais tipos de proxy ficam na mesma conta. Os números dos concorrentes vêm dos sites dos próprios provedores e são de setembro de 2026; a informação que o provedor não publica aparece como "—" na tabela.

Por que o web scraping precisa de proxy?

O web scraping é o trabalho de baixar o HTML de uma página e extrair dados estruturados de dentro dele; o proxy é o servidor intermediário que faz essa requisição no seu lugar. Quando o site de destino recebe a requisição, ele não vê a sua linha, e sim o endereço de saída do proxy. Essa diferença resolve duas coisas. A primeira é a velocidade: disparar dez requisições por segundo de um único IP joga aquele endereço acima do limite na hora; as mesmas dez requisições divididas por dez endereços deixam cada endereço na velocidade de um visitante normal. A segunda é a localização: preço, estoque, resultado de busca e conteúdo de anúncio mudam de país para país e, na maior parte das vezes, de província para província, então a página vista de Istambul devolve dados diferentes da página vista de Berlim. Sem proxy, os dados que você coleta são apenas a versão que o seu lugar e o seu IP enxergam.

Para que serve um proxy de web scraping?

  • Monitoramento de preço e estoque: você coleta preço e estoque nos marketplaces algumas vezes por dia, a partir de províncias diferentes. Detalhes: monitoramento de preços.
  • Rastreamento em larga escala: ao percorrer um site de milhares de páginas com processos simultâneos, as requisições se espalham pelos IPs. Detalhes: web crawler.
  • Extração de dados estruturados: você encaixa anúncios, produtos, avaliações e dados de empresas em um esquema organizado. Detalhes: extração de dados.
  • Acompanhamento de resultados de busca e de posições: você mede como a mesma consulta se posiciona em províncias diferentes. Detalhes: acompanhamento de posições na SERP.
  • Trabalhar sem ser bloqueado: você monta a gestão de limite de velocidade, de sessão e de cabeçalhos junto com o pool de proxies. Detalhes: como fazer web scraping sem ser bloqueado.

O que observar ao escolher um proxy para web scraping?

  • A proteção do alvo. Para um catálogo público, o IP de datacenter basta; em um alvo que exige login ou que faz análise de comportamento, é preciso IP residencial ou móvel. Usar os dois tipos no mesmo trabalho é normal, por isso importa que os dois estejam no mesmo painel.
  • Modelo de preço e prazo do tráfego. O proxy residencial é vendido por GB; o datacenter e o ISP fixo, por IP ao mês. A diferença de verdade é quando o direito que você comprou acaba: no modelo de crédito mensal, o tráfego não usado expira no fim do mês ou depois de 60 dias; no modelo de saldo, não expira.
  • Profundidade da segmentação. País não basta; é preciso poder escolher província, cidade e ASN. Em um marketplace cujo preço muda de província para província, medir a partir das 81 províncias não é o mesmo dado que medir a partir de um único ponto de saída.
  • Rotação e controle de sessão. IP novo a cada requisição, ou o mesmo IP por um tempo determinado? Em listas paginadas, se o IP muda no meio da sessão, o site zera o carrinho ou o filtro. Ter os dois no mesmo produto se resolve, do lado do código, só trocando o endpoint. A montagem do lado do Python está em rotação de proxies em Python.
  • Limites de simultaneidade e de protocolo. Quantas conexões paralelas você consegue abrir, se há suporte a SOCKS5 além de HTTP e HTTPS e se a autenticação é por usuário e senha ou por autorização de IP: isso define diretamente a sua arquitetura.

Os 5 melhores provedores de proxy para web scraping

1. Proxynet

Nos trabalhos de scraping, o primeiro endereço é a Proxynet. O pool residencial reúne mais de 160 milhões de IPs em 194 países; a segmentação por província e ASN não custa nada a mais, e a rotação e a sessão fixa ficam no mesmo produto. Na mesma conta há mais de 2 milhões de IPv4 de datacenter dedicados em mais de 50 países, mais de 240.000 IPs de ISP fixo em mais de 20 países e milhares de linhas de operadora móvel em mais de 140 países. É disso que um projeto de scraping precisa na prática: os sites da sua lista de alvos não têm a mesma proteção, e para trocar de tipo você não precisa assinar contrato com um segundo provedor.

O modelo de preço não depende de compromisso de quantidade nem de prazo, e sim do saldo da sua conta. O tráfego residencial começa no patamar de 3,30 dólares por GB e cai para o patamar de 1,50 dólares conforme o saldo aumenta; no datacenter, o preço mensal por IP começa no patamar de 1,50 dólares e cai para o patamar de 0,70 dólares, com tráfego sem cota. Não há assinatura e o saldo não expira: o dinheiro de um scraper que ficou dois meses parado continua onde estava. Nos produtos de datacenter e de ISP a entrega cai no painel no momento do pedido, há suporte a HTTP, HTTPS e SOCKS5, e a autenticação é feita por usuário e senha ou por autorização de IP.

Prós

  • Mais de 160 milhões de IPs residenciais em 194 países, segmentação por província e ASN sem custo extra
  • Mais de 2 milhões de IPv4 de datacenter dedicados em mais de 50 países, tráfego sem cota
  • Mais de 240.000 IPs de ISP fixo em mais de 20 países, todos exclusivos de um único usuário
  • Sem assinatura e sem prazo, o saldo carregado não expira e vale nos quatro produtos
  • Rotação e sessão fixa no mesmo produto, HTTP, HTTPS e SOCKS5
  • Mais de 6,2 milhões de IPs nas 81 províncias de Türkiye e linhas de operadoras turcas reais
  • Painel em turco, suporte em turco 24/7, cartão de crédito e transferência bancária

Contras

  • Não há teste gratuito, o serviço é testado com um saldo pequeno
  • A Web Scraper API é liberada por enquanto pela equipe de vendas
  • Não vende modelo de scraper pronto nem conjunto de dados, o endpoint você mesmo liga ao seu código

Para quem: equipes com lista de alvos variada, que não querem amarrar o orçamento a uma assinatura mensal e que coletam dados de Türkiye.

2. Bright Data

O maior pool residencial da lista: mais de 400 milhões de IPs. No lado do datacenter são 98 países e os 46.592 IPs que a empresa publica para Türkiye. O preço residencial por GB começa em 8 dólares e cai para 4 dólares com cupom; o menor número, 3 dólares, depende de um plano de 999 dólares por mês, e o tráfego do plano expira se não for usado dentro de um mês. No lado do scraping, além do proxy, a empresa também vende uma família de APIs prontas e conjuntos de dados.

Prós

  • O maior pool residencial da lista
  • Proxy de datacenter em 98 países e 46.592 IPs de datacenter em Türkiye
  • Segmentação por cidade, código postal e ASN
  • Ampla família de APIs de scraping, conjuntos de dados e gerenciador de proxies

Contras

  • Preço de entrada do residencial de 8 dólares por GB, o mais alto da lista
  • O menor preço por GB depende de um plano de 999 dólares por mês, e o tráfego do plano expira em um mês
  • Não publica o preço do proxy móvel
  • Não há painel em turco, suporte em turco nem pagamento local

Para quem: equipes corporativas que podem reservar orçamento para conjuntos de dados e APIs prontas.

3. Oxylabs

Provedor corporativo com mais de 175 milhões de IPs residenciais. O preço por GB começa em 6 dólares e cai para 2,50 dólares nos planos superiores. No móvel, oferece mais de 20 milhões de IPs em mais de 140 países e sessão fixa de até 24 horas. Os 6.850.844 IPs que publica para Türkiye são o maior número por país desta lista. O teste não é self-service, é liberado pela equipe de vendas ou pelo suporte ao vivo.

Prós

  • Mais de 175 milhões de IPs residenciais
  • O maior número de IPs publicado para Türkiye
  • Proxy móvel em mais de 140 países, sessão fixa de até 24 horas
  • Família de Web Scraper API e gerente de contas

Contras

  • O teste não é self-service, passa pela equipe de vendas
  • Não oferece proxy ISP fixo em Türkiye
  • No lado do datacenter não encontramos pool nem preço verificáveis
  • Não há painel em turco, suporte em turco nem pagamento local

Para quem: equipes que trabalham com orçamento corporativo e querem gerente de contas e API pronta.

4. SOAX

Fica no meio da lista, com mais de 155 milhões de IPs residenciais. O preço depende de duas variáveis: de qual faixa é o país de destino e de qual é o seu plano mensal. Na segunda faixa, onde Türkiye está, o preço por GB começa em 3,75 dólares e cai até 0,35 dólares no plano corporativo de 3.000 dólares por mês — o menor número por GB desta lista. Em Türkiye, publica 49 cidades e os nomes das operadoras turcas.

Prós

  • Mais de 155 milhões de IPs residenciais
  • Na faixa corporativa, o preço por GB desce para a parte mais baixa desta lista
  • Publica 49 cidades e os nomes das operadoras turcas em Türkiye
  • Sessão fixa de até 60 minutos no proxy móvel

Contras

  • Na fatura mensal, os créditos expiram em 60 dias
  • Os menores preços dependem do plano corporativo de 3.000 dólares por mês
  • Não há produto de ISP fixo
  • O teste é pago: 3 dias, 400 MB

Para quem: equipes de alto volume, que conseguem entrar em um plano corporativo mensal e consumir o crédito no prazo.

5. Decodo

Antiga Smartproxy. Tem mais de 115 milhões de IPs residenciais, o preço por GB começa em 4 dólares e cai para 2 dólares. No lado do datacenter conta mais de 500.000 IPs, mas o IP de datacenter dedicado só é vendido em cinco países; no móvel informa mais de 700 linhas de operadora. Tem um teste gratuito de três dias com 100 MB, e quem usa o teste perde o direito de reembolso em 14 dias.

Prós

  • O preço residencial por GB começa em 4 dólares
  • Teste gratuito de três dias com 100 MB
  • Segmentação por cidade e ASN
  • Proxy móvel com mais de 700 linhas de operadora

Contras

  • O IP de datacenter dedicado existe em apenas cinco países
  • Quem usa o teste perde o direito de reembolso em 14 dias
  • Não há uma quantidade de IPs residenciais publicada para Türkiye
  • Não há painel em turco, suporte em turco nem pagamento local

Para quem: equipes de volume médio que querem começar com um teste pequeno.

Tabelas comparativas

Os números vêm dos sites dos próprios provedores, setembro de 2026. "—" é a informação que o provedor não publica.

Pool residencial e preço por GB

ProvedorPoolEntrada (GB)Menor preço (GB)
Proxynet160 milhões+3,30 dólares1,50 dólares
Bright Data400 milhões+8 dólares3 dólares
Oxylabs175 milhões+6 dólares2,50 dólares
SOAX155 milhões+3,75 dólares0,35 dólares
Decodo115 milhões+4 dólares2 dólares

Na coluna do pool, o maior número é o da Bright Data; no preço de entrada, quem fica na parte mais baixa da lista é a Proxynet. Os 0,35 dólares da SOAX são o preço do plano corporativo de 3.000 dólares por mês, e os 3 dólares da Bright Data, o do plano de 999 dólares por mês; nenhum dos dois é um preço que você alcança com uma conta pequena. Na Proxynet, quem define a faixa não é um compromisso mensal, e sim o saldo da conta.

Tráfego, assinatura e teste

ProvedorPrazo do tráfegoAssinaturaTeste
ProxynetNão expiraNão háNão há
Bright Data1 mêsPlano mensalSim, sem detalhe
OxylabsPlano mensalEquipe de vendas
SOAX60 diasPlano mensal3 dias, pago
DecodoPlano mensal3 dias, 100 MB

Esta tabela mostra por onde o orçamento de scraping mais vaza: se o tráfego que você comprou não for usado em um mês ou em 60 dias, ele é apagado. Em um projeto sazonal de monitoramento de preços, isso quer dizer perder parte dos GB que você pagou sem nunca usar. Na Proxynet o saldo não expira, e um projeto parado por três meses continua com o mesmo saldo. Na coluna do teste quem se destaca é a Decodo; na Proxynet, em vez de teste você carrega um saldo pequeno.

Lado do datacenter

ProvedorPoolPaísesIP dedicado/mês
Proxynet2 milhões+50+1,50 dólares
Bright Data770 mil+982,20 dólares
Decodo500 mil+5 com IP dedicado1,85 dólares
Oxylabs
SOAX

Em alvos com proteção fraca, é esta tabela que define o custo: o IP de datacenter não é vendido por GB, e sim por IP ao mês. A Bright Data está na frente na quantidade de países; a Proxynet fica na parte de baixo desta lista no tamanho do pool e no preço mensal por IP. O IP de datacenter dedicado da Decodo só é vendido em cinco países e, no lado da Oxylabs e da SOAX, não encontramos um número de datacenter verificável.

Por que a Proxynet no web scraping?

O saldo não expira, não há assinatura

A carga de scraping não é regular: na semana de campanha aumenta dez vezes e depois fica semanas parada. No modelo de crédito mensal, essa oscilação é prejuízo direto, porque o tráfego não usado é apagado no fim do mês ou depois de 60 dias. Na Proxynet, o saldo que você carrega não expira e vale em todos os produtos: residencial, datacenter, ISP e móvel. Detalhes: Proxies residenciais.

194 países, segmentação por província e ASN

O pool residencial se espalha por 194 países e reúne mais de 160 milhões de IPs. A segmentação por província e ASN não custa nada a mais: quando você quer sair de uma cidade específica ou da rede de uma operadora específica, basta acrescentar um parâmetro ao endpoint. Em um marketplace cujo preço muda de província para província, a exatidão da medição depende diretamente desse detalhe.

Quatro tipos de proxy na mesma conta

A lista de alvos de um projeto de scraping não é de um tipo só. Para catálogos públicos, o Proxies de datacenter; para alvos protegidos, o Proxies residenciais; para painéis que exigem login, o Proxies ISP; para APIs de aplicativos móveis, o Proxies móveis — todos ficam no mesmo painel. Trocar de tipo não é um contrato novo, é uma mudança de endpoint.

O lado de Türkiye: 81 províncias e linhas de operadoras reais

Em Türkiye são mais de 6,2 milhões de IPs nas 81 províncias; no ISP fixo há mais de 120.000 IPs de Türkiye e linhas da Türk Telekom, Superonline, TurkNet e Vodafone Net. A rede da Türk Telekom está registrada como AS9121, ou seja, a requisição que sai dessa rede é vista pelo site de destino como tráfego de um assinante comum. Detalhes do país: proxy de Türkiye.

Painel em turco, suporte em turco, pagamento local

O painel é em turco, o suporte responde em turco 24/7 e o pagamento é feito com cartão de crédito ou transferência bancária (havale/EFT). Nenhum dos quatro provedores globais da lista tem suporte em turco e pagamento local.

Como os sites reconhecem um scraper?

A detecção tem quatro pernas e as quatro funcionam de forma independente do proxy; o proxy afeta só a primeira e a segunda.

Velocidade de requisição e 429. A medida mais simples é quantas requisições um IP faz dentro de uma janela de tempo. Quando o limite estoura, o servidor devolve o código 429 Too Many Requests, definido na RFC 6585, e em geral coloca um cabeçalho Retry-After na resposta. Esse cabeçalho não é um conselho, é o tempo de espera que o site está dizendo para você: obedecer ao valor e atrasar a requisição por esse tanto é mais saudável do que trocar de IP e seguir na mesma velocidade. Em quais códigos de status é preciso esperar e em quais é preciso parar, explicamos no artigo Códigos de status HTTP no web scraping.

Reputação do IP. Cada IP está registrado em um número de sistema autônomo e esse registro é público. Se o endereço pertence a uma empresa de hospedagem ou a um provedor de acesso, se já apareceu tráfego automático no histórico dele e qual é a situação dos endereços vizinhos formam juntos uma pontuação de reputação. Vinte IPs comprados do mesmo bloco /24 são, na maior parte das vezes, um endereço só para o site de destino: quando um é marcado, o bloco inteiro é marcado.

Assinatura do handshake TLS. Ao estabelecer a conexão HTTPS, o cliente envia em uma ordem determinada as suítes de cifras e as extensões que suporta. Essa lista muda de cliente para cliente; os registros de parâmetros TLS da IANA guardam quais valores existem. Do lado do servidor, um resumo dessa ordenação é transformado em uma assinatura e assim se descobre de que tipo de cliente veio a conexão. A assinatura de uma biblioteca HTTP não muda com um cabeçalho User-Agent que finge ser de navegador.

Impressão digital do navegador. Em alvos que executam JavaScript, as medidas da tela, a lista de fontes, as saídas de WebGL e de canvas, o fuso horário e as configurações de idioma formam juntos uma identidade. Essa identidade ser incoerente com o país que o proxy mostra — como um navegador conectado por um IP de Istambul mostrando o fuso horário de Los Angeles — já é um sinal por si só. Detalhes: impressão digital do navegador.

Todos esses mecanismos são coisas que o site montou para proteger a própria infraestrutura. A abordagem certa não é tentar contorná-los, e sim deixar a sua requisição em um formato que o site consiga aguentar: obedecer às regras do robots.txt, respeitar o valor de Retry-After, trabalhar em velocidade baixa nas horas da madrugada e, se existir, usar a API oficial. O formato das regras do robots está definido na RFC 9309. Em fontes que exigem login, que são pagas ou que contêm dados pessoais, pedir permissão não é preferência, é obrigação; reunimos o quadro jurídico no artigo Web scraping é legal?.

Qual tipo de proxy para cada alvo?

Escolha o tipo de proxy não pelo seu trabalho, e sim pela proteção do alvo. Usar os quatro tipos no mesmo projeto é comum.

Tipo de alvoTipo de proxyPor quê
Catálogo abertoDatacenterBarato e rápido
Exige loginISP fixoSessão fixa
Proteção rígidaResidencialProvíncia e ASN
API móvelMóvelIP de operadora

Catálogo público. Para listas sem login e sem JavaScript e para endpoints de API, o IP de datacenter basta; o custo é por IP ao mês e, conforme o volume aumenta, o custo unitário cai.

Site que exige login. Em páginas que pedem painel e conta, o IP precisa ficar fixo; se o endereço muda a cada requisição, o site derruba a sessão e pede uma segunda verificação.

Site com proteção antibot rígida. Em alvos que fazem análise de comportamento, ganha importância o IP estar registrado em um provedor de acesso e sair da província certa; o pool residencial entrega as duas coisas juntas.

API de aplicativo móvel. Em endpoints acessados apenas pelo aplicativo móvel, é preciso sair da rede da operadora; o proxy móvel envia a requisição por uma linha GSM real.

Falha silenciosa: volta 200, mas não há dados

Em projetos de scraping, o erro mais caro não é ser bloqueado, é não perceber que foi bloqueado. O servidor devolve 200, o código não dá erro, a quantidade de registros parece normal; mas o que está sendo gravado no banco de dados já não é dado real. Existem quatro formatos típicos.

Links honeypot. Os links que não aparecem para o usuário e que só existem no HTML são uma armadilha: um visitante comum não clica neles, um navegador automático clica. Quando são clicados, o site marca a requisição e passa a devolver páginas que parecem normais para você, mas que estão erradas por dentro. Não seguir os links que carregam display:none ou visibility:hidden já basta como regra simples. Detalhes: armadilhas honeypot.

Template vazio. Alguns sites devolvem ao cliente bloqueado não um erro, e sim o esqueleto da página sem dado nenhum. A lista de produtos chega como uma div vazia e o código HTTP é 200. Isso aparece na maioria das vezes em páginas preenchidas por JavaScript; o HTML bruto que vem do servidor e a página que o navegador enxerga não são a mesma coisa. A diferença entre os dois está em páginas estáticas e dinâmicas.

Mudança de estrutura. Quando o site atualiza o design, os nomes de classe e a estrutura do DOM mudam; os seus seletores não encontram mais nada e todo registro volta vazio. Do ponto de vista do código não há erro, o resultado é que está vazio. Amarrar os seletores a uma estrutura mais estável, e não ao nome da classe, reduz o risco: comparação entre seletor CSS e XPath.

Conteúdo de país ou de idioma errado. Se a saída do proxy não está no país que você espera, o site responde com outra moeda, outro idioma e outro estoque. Os dados parecem em ordem; o que está incoerente é só o significado deles: você acaba comparando preços puxados da Alemanha com uma campanha de Türkiye.

A forma de se proteger é um hábito só: registre algumas medidas de controle a cada execução. A quantidade de registros por página, o comprimento do corpo da resposta, a moeda e a etiqueta de idioma da página, o país do IP de saída. Se um desses quatro valores se afastar de forma visível da execução anterior, pare o trabalho e olhe. Perceber um banco de dados cheio de registros vazios leva semanas; um alerta de limiar pega o mesmo desvio já na primeira execução.

Erros comuns

  • Montar o pool inteiro com um tipo só de proxy. Pagar GB de tráfego residencial para páginas públicas é desnecessário, e ir a alvos protegidos com IP de datacenter não dá resultado. Divida a lista de alvos conforme a proteção.
  • Aumentar a simultaneidade sem olhar a quantidade de IPs. Rodar duzentos processos paralelos com vinte IPs deixa dez requisições por segundo em cada IP; isso não é diferente da sua situação antes de usar proxy.
  • Trocar de IP no 429 e seguir na mesma velocidade. Se o servidor informou um tempo de espera, cumpra. Seguir trocando de endereço é espalhar o comportamento que estoura o limite para o pool inteiro.
  • Comprar IPs do mesmo bloco /24. Se os três primeiros octetos de vinte IPs são iguais, para o site de destino eles são um endereço só. Peça IPs de blocos diferentes e, se possível, de ASNs diferentes.
  • Trocar de IP no meio da paginação. Em listas que exigem sessão, use sessão fixa; pedir a segunda página de outro IP zera o filtro na maioria dos sites.
  • Dar o trabalho por encerrado sem verificar a saída. Dado gravado sem conferir a quantidade de registros, o comprimento do corpo e o país de saída é dado de exatidão desconhecida.

Qual proxy para cada trabalho?

O seu trabalhoProduto recomendado
Rastrear catálogos públicosProxies de datacenter
Coletar dados de alvos com proteção rígidaProxies residenciais
Puxar dados de painéis que exigem loginProxies ISP
API de aplicativo móvelProxies móveis
IP diferente a cada requisiçãoProxies rotativos
O mesmo IP ao longo da paginaçãoProxies de sessão fixa

Perguntas frequentes

Qual é o melhor proxy para web scraping?

A Proxynet. Mais de 160 milhões de IPs residenciais em 194 países, segmentação por província e ASN, produtos de datacenter, ISP fixo e móvel na mesma conta, saldo que não expira e suporte em turco estão juntos só na Proxynet. Se você precisa de API de scraping pronta e de conjuntos de dados, também dá para olhar a Bright Data e a Oxylabs; se você consegue entrar em um plano corporativo de alto volume, a SOAX.

Para web scraping, devo comprar proxy residencial ou de datacenter?

Olhe a proteção do alvo. Um catálogo sem login e sem JavaScript você consegue coletar com IP de datacenter, e o custo fica bem mais baixo. Em alvos que fazem análise de comportamento, que exigem login ou que mudam o conteúdo conforme a província, é preciso IP residencial. A separação entre os dois está no artigo Diferença entre proxy residencial e datacenter.

Quanto orçamento de proxy devo reservar para scraping?

Na Proxynet, o tráfego residencial começa no patamar de 3,30 dólares por GB e cai para o patamar de 1,50 dólares conforme o saldo aumenta; no datacenter, o preço começa no patamar de 1,50 dólares por IP ao mês. Faça a conta em cima do GB: multiplique o tamanho médio da página pela quantidade diária de requisições; se você não baixa imagens e fontes, esse número sai bem abaixo do que você esperava.

Com quantos IPs devo começar?

Calcule de trás para a frente, a partir do limite de velocidade do alvo: meça quantas requisições um IP consegue fazer com folga por minuto, divida o total diário de requisições por esse número e dobre o resultado. No lado residencial, como o pool já vem com rotação, a pergunta não é de quantidade, e sim de limite de simultaneidade; no datacenter e no ISP, quem decide é a quantidade de IPs que você comprou.

Estou recebendo 429, devo aumentar a quantidade de proxies?

Primeiro baixe a velocidade. O 429 é resultado do comportamento, não do IP: se você aumentar a quantidade de proxies e seguir na mesma velocidade total, vai bater no limite de novo, só que agora com um pool maior. Obedeça ao valor de Retry-After da resposta, coloque um atraso entre as requisições e só depois disso aumente o pool.

Não. O proxy muda apenas de onde a requisição sai; o que você coleta e o que você faz com esse dado continua igual. Dados pessoais, conteúdo protegido por direitos autorais e fontes atrás de login estão sujeitos às mesmas regras também com proxy. Reunimos os limites no artigo Web scraping é legal?.

Em resumo

No scraping, quem define o resultado não é o tamanho total do pool; é conseguir escolher o tipo adequado à proteção do alvo, conseguir sair da província certa e não estar sob a pressão de usar o tráfego que você comprou antes que o prazo acabe. O provedor que oferece as três condições juntas e ainda acrescenta painel e suporte em turco é a Proxynet. Os detalhes do produto estão na página Proxies residenciais e todos os produtos, na página nossos serviços de proxy.