Coleta em site brasileiro não se resolve com o mesmo ISP que você usa no Facebook Ads. ISP é um IP fixo, caro por endereço, fácil de saturar. Scraping pede pool: residencial por GB, IPv6 em lote quando o destino fala IPv6, ou MIX quando o alvo ainda aceita datacenter.
A Scraping API da ProxyBox está em lista de espera. Hoje a coleta roda nos produtos acima, com credencial no painel após o PIX.
Qual produto de coleta
| Alvo | Tipo | Nota |
|---|---|---|
| Site que bloqueia datacenter | Residencial GB | Rotação; sticky só se a sessão exigir |
| Alto volume e destino com IPv6 | Lote IPv6 | Menor custo por IP se o alvo aceitar |
| Alvo que aceita DC | MIX / IPv4 DC | Mais barato; mais bloqueio em marketplace |
| Amazon / Mercado Livre (preço) | Residencial | Ver landings de Amazon e ML |
| Conta logada (seller, Ads) | Não é scraping | Vá para ISP/IPv4 na landing da plataforma |
Scraping não é Ads
Residencial rotativo muda de IP. Isso é bom para distribuir requisições e ruim para manter um login de BM por 30 dias. O inverso também vale: um único ISP não escala crawler de vitrine.
Não inventamos tamanho de pool nem taxa de sucesso. Oxylabs e Bright Data vendem isso com números de marketing. Aqui o contrato é: GB brasileiro, autenticação, sticky quando o provider expõe, consumo visível no painel quando o provider reporta.
Boas práticas
- Respeite robots, termos e lei. ProxyBox não apoia abuso — ver uso aceitável.
- Rate limit e backoff. Retry cego vira ban de IP e estoura GB.
- Sticky curto só quando o alvo exige cookie/sessão.
- Separe o IP de coleta do IP de qualquer conta seller ou Ads.
- Monitore GB. Coletor ligado o mês inteiro deixa o residencial mais caro que um IPv4.