170 похожих чатов

Ребят, учусь парсить, такой вопрос... я перехожу по разным

ссылкам на сайте... и при каждом переходе мне нужно указывать это: response = requests.get(data_href, headers=headers)
soup = BeautifulSoup(response.text, "lxml") или только на главной хватает?

16 ответов

7 просмотров

Это не парсинг, это скрапинг Зачем он тебе? Бесполезный ведь навык

Алпа-Н Автор вопроса
Const
Это не парсинг, это скрапинг Зачем он тебе? Беспол...

ну да скрапинг. ну зацепило.... щас вот перехожу на новую страницу и вновь пишу, подумал мож толь на главной хватит...

Рекомендую не учиться парсить, а учить как работает интернет

Алпа-Н Автор вопроса
Tishka17
Рекомендую не учиться парсить, а учить как работае...

спасибо, но тем не менее , не могли бы подсказать?

Алпа Н
спасибо, но тем не менее , не могли бы подсказать?

У тебя вопрос непонятный, а непонятный потому что глупый

Алпа-Н Автор вопроса
Tishka17
Для какой цели тебе "парсинг"?

сбор данных, которые если буду вручную писать займет года 2

Алпа-Н Автор вопроса
Tishka17
Что за данные?

астрономические, математические и физики формулы

Алпа Н
астрономические, математические и физики формулы

Так скачай себе нужный датасет, если он публичный и бери из него что нужно А если он не публичный, то и нехер в него лезть :))

Алпа-Н Автор вопроса
r nurnu
У тебя вопрос непонятный, а непонятный потому что ...

вопрос новичка не может быть глупым, может быть неполным... а спец который не поймет что хочет новичок - глуп!

Алпа Н
вопрос новичка не может быть глупым, может быть н...

Никогда не слышал ничего более абсурдного

да, для каждой если тебе требуется обработать каждую страницу. эта строчка получает ответ с сайта который ты парсишь (html код страницы): response = requests.get(data_href, headers=headers) а эта строчка переделывает html в объект beautifulsoup soup = BeautifulSoup(response.text, "lxml")

Алпа-Н Автор вопроса

Похожие вопросы

Обсуждают сегодня

Какой-то там пердун в 90-х решил, что есть какая-то разная типизация. Кого вообще это волнует?
КТ315
49
void terminal_scroll() { memmove(terminal_buffer, terminal_buffer + VGA_WIDTH, buffer_size - VGA_WIDTH); memset(terminal_buffer + buffer_size - VGA_WIDTH, 0, VGA_WIDTH); ...
Егор
47
Всем привет! Подскажите, пожалуйста, в чем ошибка? Настраиваю подключение к MySQL. Либы лежат рядом с exe. Все как по "учебнику"
Евгений
16
А можете как-то проверить меня по знаниям по ассемблеру?
A A
132
Здравствуйте! У меня появилась возможность купить книгу "Изучай Haskell во имя добра!". Но я где-то слышал, что эта книга устарела. Насколько это правда??
E
22
Здравствуйте! Я вот на stepic решаю задачи на хаскеле https://stepik.org/lesson/8443/step/8?unit=1578 мой код import Data.List (isInfixOf) removing :: String -> [String] ->...
E
10
Камрады, кто тесно работал с vtv, хотел уточнить. Ширина column задаётся жёстко на этапе создания дерева или можно в рантайме ее менять программно (не мышкой)?
Ed Doc
10
да ладно ... что там неочевидного ? глянуть в исх-ки датасета и/или кверика чтобы понять в каком месте и как выполняется обращения к св-вам blablaSQL - минутное дело, даже е...
Сергей
7
Здесь для arm кто-нибудь кодит ?
Nothing
52
Всем привет, у меня есть сервер принимающий входящие HTTP подключения, как проверить, что подключение было через прокси или нет, есть какие то поля в заголовках по которым мо...
DS
8
Карта сайта