beginner
модифицировать код, чтобы помимо текста новости, также сохранялись картинки и ссылки из новости?
так как работа с doc для проблематична
import lxml.html
with open('posts.html', 'a', encoding='utf-8') as f:
for p in range(42, 0, -1):
page = lxml.html.parse(r'http://ostanovinasilie.org/category/news/page/%d/' % p)
for i in page.xpath('.//div[starts-with(@id, "post")]//a'):
post = lxml.html.parse(i.attrib['href']).xpath('.//div[starts-with(@id, "post")]')
f.write(lxml.html.tostring(post[0], method='html').decode('utf-8'))
этот код сохраняет в html документ с картинками и ссылками
или откройте в ворде этот докмент и сохраните в формате doc, или воспользуйтесь конверторами с html в doc
P.S. если будет что-то нужно помимо этого вопроса, пишите на почту