Встречается на собеседованиях • сегодня

Расскажи о неудачном опыте

Однажды я разрабатывал веб-скрейпер для сбора данных с динамического сайта. Вначале использовал requests + BeautifulSoup, но сайт подгружал контент через AJAX. Переписал на selenium, но столкнулся с капчей после нескольких запросов.

Попытался обойти это с помощью time.sleep() и рандомных задержек, но сайт детектил бота по паттернам поведения. В итоге потратил 2 недели, но так и не получил нужные данные.

Выводы:

  1. Всегда анализируй сайт на динамический контент и защиту
  2. Для сложных случаев лучше искать API или договариваться с владельцем
  3. Готовь fallback-стратегии
python
# Пример ошибки: наивный скрейпинг AJAX-сайта
import requests
from bs4 import BeautifulSoup

url = "https://dynamic-site.com/data"
response = requests.get(url)  # Тут получаем пустой div
soup = BeautifulSoup(response.text, 'html.parser')
data = soup.find('div', {'id': 'content'})  # А данные подгружаются JS-ом
Sophi
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
Попробовать бесплатноArrow

Следующий вопрос

Это единственный вопрос по вашему фильтру

как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы