Форум сайта python.su
0
Добрый день! Попытался тут создать простое приложение, которое вытягивает со страницы в контакте значение поля “Мировоззрение” (оно представляет собой ссылку, в URL которой присутствует слово religion). Получилось следующее:
import requests, bs4, re r = requests.get('http://vk.com/antenor') soup = bs4.BeautifulSoup(r.text, 'html.parser') print(soup.find('a', href=re.compile('religion+')))
Отредактировано Simuran (Сен. 25, 2018 17:38:32)
Офлайн
0
SimuranНадо подменить user агент в requests т.к для User Agent библиотеки requests, там стр. в др. виде отдается.
import requests, bs4, re r = requests.get('http://vk.com/antenor') soup = bs4.BeautifulSoup(r.text, ‘html.parser’) print(soup.find('a', href=re.compile('religion+')))
headers = { 'User-Agent': 'Тут новый агент', } r = requests.get('http://vk.com/antenor', headers=headers)
Офлайн
0
BM21Попробовал сделать, как Вы сказали, но Питон мне выдал ошибку. Но, видимо, проблема действительно с requests, потому что в том, что оно выдаёт у меня, нет ссылки со словом religion. Но когда я открываю HTML-код в браузере, она там есть. Может быть, дело в том, что в контакте этот блок по умолчанию свёрнут?
Надо подменить user агент в requests т.к для User Agent библиотеки requests, там стр. в др. виде отдается.
Офлайн
0
SimuranПричина в User Agent я тестировал коод о котором писал вот полный.
import requests, bs4, re headers = { 'User-Agent': 'Юзер агент', } r = requests.get('http://vk.com/antenor', headers=headers) print r.text soup = bs4.BeautifulSoup(r.text, 'html.parser') print(soup.find('a', href=re.compile('religion+')))
Офлайн