Встречается на собеседованиях • сегодня

Как автоматизировать сбор данных на сайте с капчей

Для автоматизации сбора данных с сайтов, защищённых капчей, можно использовать следующие подходы:

  1. Обход капчи вручную – сохранять куки после ручного ввода капчи, чтобы повторно использовать сессию.
    Пример с requests и selenium:
    python
    from selenium import webdriver
    import time
    
    driver = webdriver.Chrome()
    driver.get("https://example.com")
    time.sleep(30)  # Время для ручного ввода капчи
    cookies = driver.get_cookies()
    driver.quit()
    

session = requests.Session()
for cookie in cookies:
session.cookies.set(cookie['name'], cookie['value'])

text

2. **Использование API сервисов распознавания** (Anti-Captcha, 2Captcha).  
Пример с `2captcha`:
```python
from python3_anticaptcha import ImageToTextTask

solver = ImageToTextTask(api_key="YOUR_KEY")
result = solver.captcha_handler(captcha_file="captcha.png")
captcha_text = result["solution"]["text"]
  1. Избегание триггеров капчи – замедление запросов, использование прокси, эмуляция поведения пользователя.

  2. Headless-браузеры (Playwright, Puppeteer) с эмуляцией действий мыши и клавиатуры.

Важно: Убедитесь, что автоматизация не нарушает правила сайта (robots.txt, ToS).

Sophi
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
Попробовать бесплатноArrow

Следующий вопрос

Это единственный вопрос по вашему фильтру

как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы