Встречается на собеседованиях • сегодня

Как реализуешь веб парсинг

Для веб-парсинга в Python чаще всего используют библиотеки requests + BeautifulSoup для статических страниц и selenium для динамических.

Пример с requests и BeautifulSoup:

python
import requests
from bs4 import BeautifulSoup

url = "https://example.com"
response = requests.get(url)
soup = BeautifulSoup(response.text, 'html.parser')

Находим все заголовки h1

titles = soup.find_all('h1')
for title in titles:
print(title.text)

text

**Для динамических страниц (`selenium`):**  
```python
from selenium import webdriver

driver = webdriver.Chrome()
driver.get("https://example.com")
dynamic_content = driver.find_element_by_id("dynamic-id")
print(dynamic_content.text)
driver.quit()

Важные нюансы:

  1. Проверяй robots.txt сайта.
  2. Добавляй задержки (time.sleep) между запросами.
  3. Используй заголовки (User-Agent), чтобы избежать блокировки.
  4. Для сложных случаев рассмотри scrapy.
Sophi
Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
Попробовать бесплатноArrow

Следующий вопрос

Это единственный вопрос по вашему фильтру

как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы