פרוקסי לאיסוף נתונים מאתרים

מאגרי MIX של עד 25,000 כתובות IP ועד 9,900 תהליכונים בו-זמנית. תעבורה בלתי מוגבלת, HTTP(S) ו-SOCKS5 בפורט אחד, גישה לפי IP ללא שם משתמש וסיסמה. שעת ניסיון עולה 1$.

  • המאגר נבדק כל 5 דקות
  • רשימת הפרוקסי מתקבלת בקישור
  • החזר בחבילות מ-3 ימים
למחירים
זרמי נתונים מעשרות אתרים מתכנסים לצומת אחד של מאגר הפרוקסי

המחיר לפי הנפח שלכם

בחרו חבילה, הזיזו את התקופה ואת מספר התהליכונים. תהליכונים שווים למספר הבקשות הבו-זמניות שהסקרייפר שולח דרך הפרוקסי.

MIX-Business מיועד לאיסוף תוצאות חיפוש של Google ולכמה פרויקטים במקביל. 16,000 כתובות מפזרות את העומס: על כל IP נופלות פחות בקשות והקאפצ'ה מופיעה פחות. אלף תהליכונים בהתחלה, עד 1,400 בתוספת.

חודש אחד
1,000

תהליכון הוא חיבור אחד בו-זמני. יותר תהליכונים — יותר עבודה באותו זמן.

$100
≈ $3.3 / יוםל-30 ימים

$100 לחודשללא תוספת עבור תהליכונים

חיסכון $350 מול יומי
כןהחזר היתרה
  • שעה אחת — $1
  • יום אחד — $15
  • 3 ימים — $35
  • שבוע אחד — $50
  • שבועיים — $75
  • חודש אחד — $100
  • 3 חודשים — $255
  • 6 חודשים — $475
קנו פרוקסי — MIX-Business

איך מחברים את הפרוקסי לסקרייפר

  1. 1
    קנו שעה ב-1$ והזינו את ה-IP של השרת שעליו רץ הסקרייפר.

    הגישה ניתנת לפי רשימה לבנה, עד 10 כתובות לחשבון. אין צורך בשם משתמש וסיסמה.

  2. 2
    העתיקו בלוח הבקרה את הקישור לרשימת הפרוקסי.

    הקישור מחזיר קובץ טקסט, פרוקסי בכל שורה: כתובת ופורט. כעשר כתובות שער, אלפי פורטים, וכל פורט הוא פרוקסי נפרד. אותו קישור עם סיומת .csv מחזיר את הרשימה עם מדינות.

  3. 3
    הזינו את הקישור לסקרייפר כמקור הפרוקסי.

    A-Parser ו-ZennoPoster קוראים אותו מחדש בעצמם. ב-Scrapy ובקוד שלכם טענו את הרשימה מחדש בסקריפט כל 10 דקות, דוגמה למטה.

  4. 4
    הגדירו את מספר התהליכונים בסקרייפר לא מעל מספר הפורטים בחבילה.

    500 ב-Basic, 1,000 ב-Business, 1,500 ב-Elite. תהליכונים נוספים נמכרים בתקופות משבוע ומעלה.

  5. 5
    בחרו פרוטוקול לפי הכלי.

    SOCKS5 עובד עם כל תעבורת TCP; HTTP(S) מתאים לכלים ללא תמיכת SOCKS. שניהם זמינים באותו פורט.

כך הרשימה נטענת ב-Python. החליפו את PROXY_LIST_URL_FROM_DASHBOARD בקישור מלוח הבקרה והשאירו את השאר כמו שהוא.

import random, time, requests

PROXY_LIST_URL = "PROXY_LIST_URL_FROM_DASHBOARD"
REFRESH_SEC = 600

_pool, _loaded = [], 0

def pool():
    global _pool, _loaded
    if time.time() - _loaded > REFRESH_SEC:
        text = requests.get(PROXY_LIST_URL, timeout=15).text
        _pool = [line.strip() for line in text.splitlines() if ":" in line]
        _loaded = time.time()
    return _pool

def fetch(url, tries=3):
    for _ in range(tries):
        proxy = random.choice(pool())
        try:
            return requests.get(url, timeout=15,
                                proxies={"http": f"socks5h://{proxy}", "https": f"socks5h://{proxy}"})
        except requests.RequestException:
            continue
    return None

איזו חבילה לקחת לאיסוף נתונים

MIX-Basic

8,000 IP · 500–900 תהליכונים

מ-50$ לחודש

חבילת התחלה לתרחיש איסוף אחד. קחו אותה כשהסקרייפר רץ לפי לוח זמנים ולא מסביב לשעון.

MIX-Business

16,000 IP · 1,000–1,400 תהליכונים

מ-100$ לחודש

חבילה לצוותים וסוכנויות: שניים-שלושה סקרייפרים על מאגר אחד, דירוגי חיפוש ומחירי מתחרים בתוכנית אחת.

MIX-Elite

25,000 IP · 1,500–9,900 תהליכונים

מ-150$ לחודש

חבילה לאיסוף רציף: הרזרבה הגדולה ביותר של כתובות, ותהליכונים שניתן להוסיף עד 9,900.

חמש הגדרות ששומרות על המאגר

  • פסק זמן של 10–15 שניות ושני ניסיונות חוזרים דרך פרוקסי אחר. בקשה תקועה עולה יותר מבקשה שדילגתם עליה.
  • טענו את הרשימה מחדש כל 10 דקות: כך תעבדו עם כתובות שעברו בדיקה ב-5 הדקות האחרונות.
  • הגבילו את תדירות הבקשות לכל דומיין. האתר רואה את התדירות מכל IP, וזרם צפוף מכתובת אחת מפעיל קאפצ'ה.
  • אל תסתמכו על אותו IP יציאה מעבר לסשן אחד: המאגר חי והכתובות מוחלפות.
  • שמרו כמה תהליכונים רזרביים למשימות קריטיות, כך שנפילה של כתובת אחת לא תעצור את כל האיסוף.

שאלות על פרוקסי לאיסוף נתונים

01כמה כתובות IP ייחודיות אקבל?
כמו שיש במאגר החבילה: 8,000 ב-Basic, 16,000 ב-Business, 25,000 ב-Elite. ברשימה עצמה תראו כעשר כתובות שער ואלפי פורטים: כל פורט הוא פרוקסי נפרד. טענו את הרשימה מחדש כל 10 דקות כדי לעבוד עם כתובות שנבדקו זה עתה.
02האם הפרוקסי האלה מתאימים לאיסוף תוצאות Google?
כן. הקאפצ'ה במנועי חיפוש תלויה בתדירות הבקשות מ-IP אחד, לכן פזרו את הבקשות על כל המאגר והשאירו הפסקות ביניהן. לאיסוף קבוע של תוצאות קחו Business או Elite: רזרבת הכתובות גדולה יותר.
03צריך שם משתמש וסיסמה?
לפי ה-IP של המכונה שאתם מזינים בהזמנה: הפרוקסי מתחילים להעביר אותה, ובלי שם משתמש וסיסמה. עד 10 כתובות לחשבון, ואפשר לשנות אותן בלוח הבקרה בכל רגע.
04HTTP או SOCKS5?
שניהם, באותו פורט. SOCKS5 מעביר כל תעבורת TCP ולא נוגע בכותרות. בחרו HTTP(S) אם הכלי שלכם לא מדבר SOCKS.
05אפשר לקחת פרוקסי רק ממדינות מסוימות?
כן. אותו קישור מספק את הרשימה גם כ-CSV: עמודות ip, port, country, speed, uptime, real_ip, מופרדות בנקודה-פסיק, מדינה בקוד של שתי אותיות. מאגר MIX מכסה את כל העולם, וכל מדינה או קבוצת מדינות אתם בוחרים בעצמכם בסקריפט למטה. הדוגמה לוקחת את הודו ואינדונזיה: הסקרייפר מקבל קובץ רק עם הכתובות האלה, ושינוי הקודים הוא עריכה של שורה אחת.
import csv, io, requests

CSV_URL = "PROXY_LIST_URL_FROM_DASHBOARD.csv"
COUNTRIES = {"in", "id"}
OUT_FILE = "proxies_in_id.txt"

text = requests.get(CSV_URL, timeout=15).text
rows = csv.DictReader(io.StringIO(text), delimiter=";")
picked = [f"{r['ip']}:{r['port']}" for r in rows if r["country"].lower() in COUNTRIES]

with open(OUT_FILE, "w") as f:
    f.write("\n".join(picked) + "\n")
print(f"{len(picked)} proxies saved to {OUT_FILE}")
06מה אם הפרוקסי לא מתאימים לי?
קחו שעה ב-1$ והריצו עליה את הסקרייפר שלכם. בחבילות מ-3 ימים יש החזר: בטלו את המנוי בלוח הבקרה, הזמן שנוצל מחושב לפי התעריף הרגיל והיתרה חוזרת ליתרה שלכם.

שאר התשובות נמצאות בשאלות הנפוצות, וכל התוכניות בדף הבית.

התחילו משעה ב-1$

בדקו את המאגר עם הסקרייפר שלכם, ואז בחרו תקופה. בחבילות מ-3 ימים היתרה חוזרת לחשבון.

פרוקסי לניסיון ב-1$
התחברות/הרשמה