Прокси для SEO-софта

Краулер обходит сайт в сотни потоков, и любой сервер рано или поздно отвечает ему 429. Пул МИКС до 25 000 IP разводит эти потоки по разным адресам, поэтому Screaming Frog, Netpeak Spider, A-Parser и Key Collector работают на полной скорости, а не в один поток с паузами. Час теста стоит $1.

  • Трафик не тарифицируется
  • SOCKS5 и HTTP на одном порту
  • Возврат на пакетах от 3 суток
К ценам
Инструменты SEO-аудита сходятся к одному прокси-узлу, от которого идут связи к страницам сайтов

Цена за ваш объём

Выберите пакет, сдвиньте срок и число потоков. Потоки здесь это те же threads, что вы ставите в настройках краулера: 1 200 потоков это 1 200 URL, которые софт тянет одновременно. Ползунок стоит на этом значении.

MIX-Business рассчитан на SEO-отдел и агентство: несколько проектов в неделю, Sitebulb и SEO PowerSuite параллельно, A-Parser на сбор подсказок и выдачи, ScrapeBox на массовые проверки. 16 000 адресов и 1 200 потоков по умолчанию: столько ставят в краулере, когда обход нужен за вечер, а не за ночь.

1 месяц
1 200+20%

Поток — одно одновременное соединение. Больше потоков — больше сделано за то же время.

$120
≈ $4 / деньза 30 дней

$100 за месяц+ $20 за потоки

экономия $420 к посуточной
ДАвозврат остатка
  • 1 час — $1
  • 1 день — $15
  • 3 дня — $35
  • 1 неделя — $50
  • 2 недели — $75
  • 1 месяц — $100
  • 3 месяца — $255
  • 6 месяцев — $475
Купить прокси — MIX-Business

Как подключить прокси к SEO-софту

  1. 1
    Купите час за $1 и укажите IP машины, с которой работает софт.

    Доступ привязывается к самому компьютеру или серверу, поэтому в настройках прокси у Screaming Frog и Netpeak поля логина и пароля остаются пустыми. Таких машин может быть до десяти.

  2. 2
    Возьмите в кабинете ссылку на список прокси.

    По ней отдаётся текстовый файл в формате адрес и порт, строка на прокси. Screaming Frog и Netpeak ждут такой же список, только файлом: сохраните ответ в .txt и укажите его в настройках.

  3. 3
    Разложите пул по инструментам.

    A-Parser и ScrapeBox перечитывают ссылку сами и берут из неё все адреса. Key Collector, Sitebulb и SEO PowerSuite читают файл со списком, поэтому обновляйте его скриптом раз в 10 минут, пример ниже.

  4. 4
    Выставьте потоки софта не выше числа портов в пакете.

    500 у Basic, 1 000 у Business, 1 500 у Elite без докупки. Каждый порт это отдельный прокси, и один поток краулера занимает один порт: ставить в Screaming Frog больше потоков, чем портов в пакете, смысла нет.

  5. 5
    Выберите протокол под инструмент.

    SOCKS5 берут Screaming Frog, A-Parser, ZennoPoster и ScrapeBox. Netpeak Spider, Key Collector и SEO PowerSuite ходят через HTTP(S). Оба протокола висят на одном и том же порту, переключение только в настройках софта.

Так пул подключается к своему аудиту. Скрипт читает адреса из urls.txt, тянет каждую страницу через случайный прокси и складывает в audit.csv код ответа, редирект, title, h1, описание, canonical и robots — то же, что показывает краулер, только под ваши правила. Подставьте ссылку из кабинета вместо PROXY_LIST_URL_FROM_DASHBOARD.

# pip install requests[socks]
import csv, random, re, time, requests
from concurrent.futures import ThreadPoolExecutor

PROXY_LIST_URL = "PROXY_LIST_URL_FROM_DASHBOARD"
REFRESH_SEC = 600
THREADS = 1200
HEADERS = {"User-Agent": "Mozilla/5.0 (compatible; SeoAudit/1.0)", "Accept-Language": "en-US,en;q=0.9"}

_pool, _loaded = [], 0

def pool():
    global _pool, _loaded
    if time.time() - _loaded > REFRESH_SEC:
        text = requests.get(PROXY_LIST_URL, timeout=15).text
        _pool = [line.strip() for line in text.splitlines() if ":" in line]
        _loaded = time.time()
    return _pool

def first(pattern, html):
    match = re.search(pattern, html, re.S | re.I)
    return re.sub(r"\s+", " ", re.sub(r"<[^>]+>", " ", match.group(1))).strip() if match else ""

def audit(url, tries=3):
    for _ in range(tries):
        proxy = random.choice(pool())
        try:
            r = requests.get(url, headers=HEADERS, timeout=20, allow_redirects=False,
                             proxies={"http": f"socks5h://{proxy}", "https": f"socks5h://{proxy}"})
        except requests.RequestException:
            continue
        html = r.text if "html" in r.headers.get("Content-Type", "") else ""
        return {
            "url": url,
            "status": r.status_code,
            "redirect": r.headers.get("Location", ""),
            "title": first(r"<title[^>]*>(.*?)</title>", html),
            "h1": first(r"<h1[^>]*>(.*?)</h1>", html),
            "description": first(r'<meta[^>]+name="description"[^>]+content="([^"]*)"', html),
            "canonical": first(r'<link[^>]+rel="canonical"[^>]+href="([^"]*)"', html),
            "robots": first(r'<meta[^>]+name="robots"[^>]+content="([^"]*)"', html),
        }
    return {"url": url, "status": 0, "redirect": "", "title": "", "h1": "",
            "description": "", "canonical": "", "robots": ""}

urls = [line.strip() for line in open("urls.txt") if line.strip()]
fields = ["url", "status", "redirect", "title", "h1", "description", "canonical", "robots"]
with open("audit.csv", "w", newline="", encoding="utf-8") as out:
    writer = csv.DictWriter(out, fieldnames=fields, delimiter=";")
    writer.writeheader()
    with ThreadPoolExecutor(THREADS) as executor:
        for row in executor.map(audit, urls):
            writer.writerow(row)
            print(row["status"], row["url"], row["title"][:60])

Какой пакет взять под SEO-софт

MIX-Basic

8 000 IP · 500–900 потоков

от $50 в месяц

Один проект: обход до сотни тысяч URL, сбор семантики, проверка ссылок раз в неделю.

MIX-Business

16 000 IP · 1 000–1 400 потоков

от $100 в месяц

Агентство и SEO-отдел: несколько краулеров разом, сбор подсказок и массовые проверки на одном пуле.

MIX-Elite

25 000 IP · 1 500–9 900 потоков

от $150 в месяц

Свой сервис и крупный инхаус: миллионы URL за обход, потоки до 9 900, работа круглые сутки.

Пять настроек, которые берегут пул

  • Ограничьте краулер по URL в секунду на домен, а не только по потокам. Сервер считает частоту, и 1 200 потоков в один домен без лимита это гарантированный 429.
  • Ставьте в краулере таймаут 20 секунд и два повтора через другой прокси: на большом обходе зависшие запросы съедают больше времени, чем пропущенные страницы.
  • Не тяните картинки, шрифты и CSS, если проверяете метатеги. В Screaming Frog это снимается галочками в Configuration, и обход ускоряется в разы.
  • Robots.txt читайте один раз и кэшируйте: краулер, который дёргает его перед каждой страницей, тратит половину пула впустую.
  • Перед большим обходом отберите самые быстрые адреса из CSV, скрипт ниже сортирует список по колонке speed.

Вопросы про прокси для SEO-софта

01С каким софтом это работает?
С любым, который принимает список прокси: Screaming Frog SEO Spider, Netpeak Spider и Checker, Sitebulb, SEO PowerSuite, A-Parser, Key Collector, KeyAssort, ScrapeBox, GSA Search Engine Ranker, ZennoPoster, Xenu's Link Sleuth. Сервисы вроде Ahrefs и Semrush ходят по своей инфраструктуре, им пул не нужен.
02Сколько потоков ставить в Screaming Frog?
Не больше числа портов в пакете: 500 на Basic, 1 000 на Business, 1 500 на Elite. И держите лимит по URL в секунду на домен, иначе упрётесь не в пул, а в защиту сайта, который обходите.
03Как краулер авторизуется на прокси?
Никак: авторизация идёт по IP машины, который вы вписали при заказе. В настройках прокси Screaming Frog или Netpeak поля логина и пароля остаются пустыми, менять список машин можно в кабинете.
04Хватит ли пула на обход в миллион URL?
Да, трафик не тарифицируется, и объём страниц на цену не влияет. Упор идёт не в пул, а в частоту запросов к одному домену: миллион URL одного сайта разумнее обходить с лимитом и за несколько проходов.
05Можно ли собирать выдачу и подсказки по регионам?
Да, для этого в списке есть страна у каждого адреса. Возьмите список в формате CSV: колонки ip, port, country, speed, uptime, real_ip через точку с запятой. Скрипт ниже сортирует пул по колонке speed и оставляет самые быстрые адреса, а фильтр по country добавляется одной строкой.
import csv, io, requests

CSV_URL = "PROXY_LIST_URL_FROM_DASHBOARD.csv"
TAKE = 1200
OUT_FILE = "proxies_fast.txt"

text = requests.get(CSV_URL, timeout=15).text
rows = list(csv.DictReader(io.StringIO(text), delimiter=";"))
rows.sort(key=lambda r: int(r["speed"]), reverse=True)
picked = [f"{r['ip']}:{r['port']}" for r in rows[:TAKE]]

with open(OUT_FILE, "w") as f:
    f.write("\n".join(picked) + "\n")
print(f"{len(picked)} proxies saved to {OUT_FILE}")
06Что если краулер не поедет на этом пуле?
Возьмите час за $1 и запустите на нём обычный обход: за час видно и скорость, и долю ответов 429. Пакеты от 3 суток отменяются в кабинете, использованное время пересчитают по обычному тарифу, остаток вернётся на баланс.

Остальное про сервис собрано в общем FAQ, все пакеты с ценами на главной.

Начните с часа за $1

Запустите свой краулер на пуле за час, посмотрите скорость обхода, потом берите срок. На пакетах от 3 суток остаток вернётся на баланс.

Прокси на тест за $1
ВХОД/РЕГИСТРАЦИЯ