diff --git a/.idea/misc.xml b/.idea/misc.xml index 339812c..d56657a 100644 --- a/.idea/misc.xml +++ b/.idea/misc.xml @@ -1,4 +1,4 @@ - + \ No newline at end of file diff --git a/.idea/workspace.xml b/.idea/workspace.xml index 7149d7f..4af5b6a 100644 --- a/.idea/workspace.xml +++ b/.idea/workspace.xml @@ -1,16 +1,28 @@ + + - - - + + + + + + - - - - + { + "keyToString": { + "RunOnceActivity.OpenProjectViewOnStart": "true", + "RunOnceActivity.ShowReadmeOnStart": "true", + "WebServerToolWindowFactoryState": "false", + "last_opened_file_path": "C:/Users/Alex/c22712", + "settings.editor.selected.configurable": "vcs.Git" + } +} @@ -38,6 +55,7 @@ + + - diff --git a/venv/task 1/Bogomolov b/venv/task 1/Bogomolov new file mode 100644 index 0000000..0ef76ef --- /dev/null +++ b/venv/task 1/Bogomolov @@ -0,0 +1,2 @@ +Did you know diarrhea is hereditary? +It runs in your jeans \ No newline at end of file diff --git a/Задания/task1/Antipenko/ada.main.py b/Задания/task1/Antipenko/ada.main.py new file mode 100644 index 0000000..251ea80 --- /dev/null +++ b/Задания/task1/Antipenko/ada.main.py @@ -0,0 +1,18 @@ +from bs4 import BeautifulSoup +from selenium import webdriver +from selenium.webdriver.chrome.service import Service +import time + +S = Service('D:\teach\Prog\chromedriver.exe') #Открыли драйвер для хрома +browser = webdriver.Chrome(service=S) #Инициировали в отдельную переменную +browser.get('https://www.kinopoisk.ru/lists/movies/top250/') +html_text = browser.page_source +time.sleep(20) +soup = BeautifulSoup(html_text, 'lxml') +films = soup.find_all('div', class_='base-movie-main-info_mainInfo__ZL_u3') +''' +print(soup) +print(films) +''' +for film in films: + print(film.text) diff --git a/Задания/task1/Epifanov/Test b/Задания/task1/Epifanov/Test new file mode 100644 index 0000000..f32aab1 --- /dev/null +++ b/Задания/task1/Epifanov/Test @@ -0,0 +1 @@ +Тестовый файл diff --git a/Задания/task1/Epifanov/Парсинг.py b/Задания/task1/Epifanov/Парсинг.py new file mode 100644 index 0000000..8914bf7 --- /dev/null +++ b/Задания/task1/Epifanov/Парсинг.py @@ -0,0 +1,13 @@ +from bs4 import BeautifulSoup +from selenium import webdriver +from selenium.webdriver.chrome.service import Service + +s = Service('C:\Desktop\exe\chromedriver.exe') +browser = webdriver.Chrome(service=s) +browser.get('https://pythonpip.ru/examples/kak-posmotret-ustanovlennye-moduli-python-i-vyvesti-ih-spisok') +html_text = browser.page_source +print(html_text) +soup = BeautifulSoup(html_text, 'lxml') +infos = soup.find_all(attrs={"class":"relpost-block-single-text"}) +for info in infos: + print(info.text) diff --git a/Задания/task1/Filcheva/Заданий1 b/Задания/task1/Filcheva/Заданий1 new file mode 100644 index 0000000..3a9d041 --- /dev/null +++ b/Задания/task1/Filcheva/Заданий1 @@ -0,0 +1 @@ +Задание1 diff --git a/Задания/task1/Garanyan/main.py b/Задания/task1/Garanyan/main.py new file mode 100644 index 0000000..5cf8376 --- /dev/null +++ b/Задания/task1/Garanyan/main.py @@ -0,0 +1,12 @@ +from bs4 import BeautifulSoup +from selenium import webdriver +from selenium.webdriver.chrome.service import Service + +s = Service("E:\data\chromedriver.exe") +browser = webdriver.Chrome(service=s) +browser.get("https://www.litres.ru/fedor-dostoevskiy/prestuplenie-i-nakazanie/") +html_text = browser.page_source +soup = BeautifulSoup(html_text, 'lxml') +books = soup.find_all('div', class_='biblio_book_descr') +for book in books: + print(book.text) diff --git a/Задания/task1/Garanyan/test.txt b/Задания/task1/Garanyan/test.txt new file mode 100644 index 0000000..e69de29 diff --git a/Задания/task1/Gasanova/laba b/Задания/task1/Gasanova/laba new file mode 100644 index 0000000..980a0d5 --- /dev/null +++ b/Задания/task1/Gasanova/laba @@ -0,0 +1 @@ +Hello World! diff --git a/Задания/task1/Gasanova/parser.py b/Задания/task1/Gasanova/parser.py new file mode 100644 index 0000000..a2f1561 --- /dev/null +++ b/Задания/task1/Gasanova/parser.py @@ -0,0 +1,9 @@ +#made by dialuna (or just Diana Gasanova) <3 +import requests +from bs4 import BeautifulSoup as bs +URL = "https://www.kinopoisk.ru/lists/movies/top-250-2020/" +r = requests.get(URL, timeout=10) +soup = bs(r.text, "html.parser") +films = soup.find_all(attrs={"class": "styles_mainTitle__IFQyZ styles_activeMovieTittle__kJdJj"}) +for film in films: + print(film.text) diff --git a/Задания/task1/Gusev/First code.py b/Задания/task1/Gusev/First code.py new file mode 100644 index 0000000..bc4200d --- /dev/null +++ b/Задания/task1/Gusev/First code.py @@ -0,0 +1 @@ +print('Hello, World!') \ No newline at end of file diff --git a/Задания/task1/Kluchinskaya1/File b/Задания/task1/Kluchinskaya1/File new file mode 100644 index 0000000..8e27be7 --- /dev/null +++ b/Задания/task1/Kluchinskaya1/File @@ -0,0 +1 @@ +text diff --git a/Задания/task1/Kulikov/main.py b/Задания/task1/Kulikov/main.py new file mode 100644 index 0000000..8bcd915 --- /dev/null +++ b/Задания/task1/Kulikov/main.py @@ -0,0 +1,25 @@ +# pip install selenium bs4 + + +from bs4 import BeautifulSoup +from selenium import webdriver +from selenium.webdriver.chrome.service import Service +from time import sleep + + +s = Service("C:\\Users\\Alex\\PycharmProjects\\pythonProject\\chromedriver.exe") +brow = webdriver.Chrome(service=s) + +# brow.get("https://www.kinopoisk.ru/lists/movies/top250/") +brow.get("https://www.revshells.com/") +sleep(10) + +html = brow.page_source + +soup = BeautifulSoup(html, "lxml") + +# films = soup.find_all(attrs={"class": "styles_mainTitle__IFQyZ styles_activeMovieTittle__kJdJj"}) +buttons = soup.find_all(attrs={"class": "list-group-item list-group-item-action"}) + +for button in buttons: + print(button.text) \ No newline at end of file diff --git a/Задания/task1/Kulikov/test b/Задания/task1/Kulikov/test new file mode 100644 index 0000000..9daeafb --- /dev/null +++ b/Задания/task1/Kulikov/test @@ -0,0 +1 @@ +test diff --git a/Задания/task1/Kulish/test b/Задания/task1/Kulish/test new file mode 100644 index 0000000..fdaaa89 --- /dev/null +++ b/Задания/task1/Kulish/test @@ -0,0 +1 @@ +regterg sdgsd sd \ No newline at end of file diff --git a/Задания/task1/Kuranova/1.py b/Задания/task1/Kuranova/1.py new file mode 100644 index 0000000..1385fe3 --- /dev/null +++ b/Задания/task1/Kuranova/1.py @@ -0,0 +1 @@ +print("Hello, world!") \ No newline at end of file diff --git a/Задания/task1/Kuznetsov/test b/Задания/task1/Kuznetsov/test new file mode 100644 index 0000000..9daeafb --- /dev/null +++ b/Задания/task1/Kuznetsov/test @@ -0,0 +1 @@ +test diff --git a/Задания/task1/Lahin/parsing.py b/Задания/task1/Lahin/parsing.py new file mode 100644 index 0000000..42c83eb --- /dev/null +++ b/Задания/task1/Lahin/parsing.py @@ -0,0 +1,14 @@ +from bs4 import BeautifulSoup +from selenium import webdriver +from selenium.webdriver.chrome.service import Service +from time import sleep +s = Service("С:\DATA\ChromeDriver\chromedriver.exe") +browser = webdriver.Chrome(service=s) +browser.get("https://www.kinopoisk.ru/lists/movies/top250/") +sleep(15) +html_text = browser.page_source +soup = BeautifulSoup(html_text, 'lxml') +films = soup.find_all('div', class_="desktop-list-main-info_secondaryTitleSlot__mc0mI") +for film in films: + print(film.text) + print("--------") diff --git a/Задания/task1/Lahin/test b/Задания/task1/Lahin/test new file mode 100644 index 0000000..9a3087c --- /dev/null +++ b/Задания/task1/Lahin/test @@ -0,0 +1 @@ +Ок diff --git a/Задания/task1/Lahin/test1 b/Задания/task1/Lahin/test1 new file mode 100644 index 0000000..e69de29 diff --git a/Задания/task1/Markovich/test b/Задания/task1/Markovich/test new file mode 100644 index 0000000..f35d3e6 --- /dev/null +++ b/Задания/task1/Markovich/test @@ -0,0 +1 @@ +hello world diff --git a/Задания/task1/Prokhorova/eijd b/Задания/task1/Prokhorova/eijd new file mode 100644 index 0000000..0f675fc --- /dev/null +++ b/Задания/task1/Prokhorova/eijd @@ -0,0 +1 @@ +eijdieid diff --git a/Задания/task1/Sukhanov/huh b/Задания/task1/Sukhanov/huh new file mode 100644 index 0000000..505219c --- /dev/null +++ b/Задания/task1/Sukhanov/huh @@ -0,0 +1 @@ +ghg \ No newline at end of file diff --git a/Задания/task1/Uskova/test b/Задания/task1/Uskova/test new file mode 100644 index 0000000..6278b36 --- /dev/null +++ b/Задания/task1/Uskova/test @@ -0,0 +1 @@ +hello!! \ No newline at end of file diff --git a/Задания/task1/Yaroshevskiy/main.py b/Задания/task1/Yaroshevskiy/main.py new file mode 100644 index 0000000..fae989b --- /dev/null +++ b/Задания/task1/Yaroshevskiy/main.py @@ -0,0 +1,40 @@ +# установи python, pip + +# выполни эту команду: pip install selenium bs4 lxml +# если ты используешь pycharm, то надо библиотеки ставить не в консоли(терминале), а в самом pycharm +# для этого нажми "view" > "tool windows" > "python packages" +# внизу в окне поиска ищи нужные библиотеки +# когда найдешь, нажимай на нее, справа будет кнопка "install package", устанавливай, потом перезапусти pycharm + +# найди версию своего браузера +# напиши в гугле "скачать драйвер для <название и версия твоего браузера> selenium" +# теперь все готово для запуска этого +# помните, что сам сайт(который вы хотите парсить) может вас блокировать или заставлять проходить capture, из-за чего этот код ничего не выведет + +from bs4 import BeautifulSoup +from selenium import webdriver +from selenium.webdriver.chrome.service import Service +# импортируем всё нужное + +s = Service("путь_до_драйвера") # в ковычках указываем полный путь до скаченного ранее драйвера +# если ты на винде, то вместо знака "\" пиши "\\" + +brow = webdriver.Chrome(service=s) # как будто создаем виртуальный браузер + +brow.get("https://www.revshells.com/") # получаем html код сайта и другую информацию(она нам не нужна сейчас) + +html = brow.page_source # копируем html код в переменную + +soup = BeautifulSoup(html, "lxml") # создаем специальный парсер + +buttons = soup.find_all(attrs={"class": "list-group-item list-group-item-action"}) +# получаем список всех html тегов, в которых есть атрибут "class", равный: "list-group-item list-group-item-action" + +for button in buttons: + # выводим текст каждого тега + print(button.text) + +# от сердца и почек +# дарю вам питончик +# made by perfecto + diff --git a/Задания/task1/dg/fgdgf b/Задания/task1/dg/fgdgf new file mode 100644 index 0000000..31721d3 --- /dev/null +++ b/Задания/task1/dg/fgdgf @@ -0,0 +1 @@ +gfyfghf \ No newline at end of file diff --git a/Задания/task1/nikitin/test1 b/Задания/task1/nikitin/test1 new file mode 100644 index 0000000..c16d8fa --- /dev/null +++ b/Задания/task1/nikitin/test1 @@ -0,0 +1 @@ +Чатик, чатик \ No newline at end of file diff --git a/Задания/task1/romanov/num1 b/Задания/task1/romanov/num1 new file mode 100644 index 0000000..34ad16a --- /dev/null +++ b/Задания/task1/romanov/num1 @@ -0,0 +1 @@ +def print_hi(' hello') \ No newline at end of file diff --git a/Задания/task1/Задание b/Задания/task1/Задание new file mode 100644 index 0000000..6053eab --- /dev/null +++ b/Задания/task1/Задание @@ -0,0 +1 @@ +Проверка работы. \ No newline at end of file