mirror of
https://github.com/KUlishevgeniy/c22712.git
synced 2026-09-23 23:50:21 +00:00
задание 1
This commit is contained in:
@@ -0,0 +1,21 @@
|
||||
|
||||
|
||||
from bs4 import BeautifulSoup
|
||||
from selenium.webdriver import Chrome
|
||||
from selenium import webdriver
|
||||
from selenium.webdriver.chrome.service import Service
|
||||
|
||||
# Selenium - библиотека для автоматизации действий веб браузера, скрапинга
|
||||
# запускаем браузер
|
||||
s = Service('C:\data\hrome\chromedriver.exe')
|
||||
browser = webdriver.Chrome(service=s)
|
||||
browser.get('https://www.kinopoisk.ru/lists/movies/top250/')
|
||||
html_text = browser.page_source
|
||||
soup = BeautifulSoup(html_text, 'lxml')
|
||||
films=soup.find_all('div', class_='base-movie-main-info_mainInfo__ZL_u3')
|
||||
print (films[0].text)
|
||||
|
||||
# Это пример парсинга. Вам необходимо спарсить 1 страницу каталога любого сайта на выбор.
|
||||
# Спарсить необходимо только Заголовки и описание.
|
||||
|
||||
|
||||
Reference in New Issue
Block a user