Встречается на 1% собеседований по Python
Какие знаешь библиотеки для работы с веб парсингом
В Python есть несколько популярных библиотек для веб-парсинга:
-
BeautifulSoup — удобна для разбора HTML/XML, часто используется вместе с
requests.pythonfrom bs4 import BeautifulSoup import requests response = requests.get('https://example.com') soup = BeautifulSoup(response.text, 'html.parser') print(soup.title.string) -
Scrapy — мощный фреймворк для парсинга и краулинга, поддерживает асинхронность.
pythonimport scrapy class MySpider(scrapy.Spider): name = 'example' start_urls = ['https://example.com'] def parse(self, response): yield {'title': response.css('title::text').get()}
-
lxml — быстрая библиотека для парсинга XML/HTML, работает через XPath.
pythonfrom lxml import html tree = html.fromstring(requests.get('https://example.com').content) print(tree.xpath('//title/text()')[0]) -
Selenium — автоматизирует браузер, подходит для динамических страниц (JS).
pythonfrom selenium import webdriver driver = webdriver.Chrome() driver.get('https://example.com') print(driver.title) driver.quit()
Выбор зависит от задачи: для статичных страниц — BeautifulSoup/lxml, для сложных — Scrapy или Selenium.

Софи собрала все вопросы. Тренируйся и получай
офферы быстрее!
офферы быстрее!
Попробовать бесплатно
Следующий вопрос
Это единственный вопрос по вашему фильтру
Похожие вопросы
как отвечать на вопрос
пример собеседования
фреймворки на собеседовании
типичные вопросы junior
интервью вопросы и ответы