mirror of
https://github.com/KUlishevgeniy/c22712.git
synced 2026-09-23 23:50:21 +00:00
22 lines
892 B
Python
22 lines
892 B
Python
|
|
|
|
from bs4 import BeautifulSoup
|
|
from selenium.webdriver import Chrome
|
|
from selenium import webdriver
|
|
from selenium.webdriver.chrome.service import Service
|
|
|
|
# Selenium - библиотека для автоматизации действий веб браузера, скрапинга
|
|
# запускаем браузер
|
|
s = Service('C:\data\hrome\chromedriver.exe')
|
|
browser = webdriver.Chrome(service=s)
|
|
browser.get('https://www.kinopoisk.ru/lists/movies/top250/')
|
|
html_text = browser.page_source
|
|
soup = BeautifulSoup(html_text, 'lxml')
|
|
films=soup.find_all('div', class_='base-movie-main-info_mainInfo__ZL_u3')
|
|
print (films[0].text)
|
|
|
|
# Это пример парсинга. Вам необходимо спарсить 1 страницу каталога любого сайта на выбор.
|
|
# Спарсить необходимо только Заголовки и описание.
|
|
|
|
|