Встречается на 2% собеседований по Python
Как реализуешь веб парсинг
Для веб-парсинга в Python чаще всего используют библиотеки requests + BeautifulSoup для статических страниц и selenium для динамических.
Пример с requests и BeautifulSoup:
python
import requests
from bs4 import BeautifulSoup
url = "https://example.com"
response = requests.get(url)
soup = BeautifulSoup(response.text, 'html.parser')
Находим все заголовки h1
titles = soup.find_all('h1')
for title in titles:
print(title.text)
text
**Для динамических страниц (`selenium`):**
```python
from selenium import webdriver
driver = webdriver.Chrome()
driver.get("https://example.com")
dynamic_content = driver.find_element_by_id("dynamic-id")
print(dynamic_content.text)
driver.quit()Важные нюансы:
- Проверяй
robots.txtсайта. - Добавляй задержки (
time.sleep) между запросами. - Используй заголовки (
User-Agent), чтобы избежать блокировки. - Для сложных случаев рассмотри
scrapy.

Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
офферы быстрее!
Попробовать бесплатно
Следующий вопрос
Это единственный вопрос по вашему фильтру
Похожие вопросы
как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы