Уведомления

Группа в Telegram: @pythonsu

#1 Янв. 23, 2016 15:24:18

Zverushko
Зарегистрирован: 2013-04-22
Сообщения: 17
Репутация: +  0  -
Профиль   Отправить e-mail  

Парсинг xml

Здравствуйте!
Есть xml в котором есть такой тег:

<title>
              Услуги 
              <hlword>
                эвакуатора
              </hlword>
              в 
              <hlword>
                Тамбове
              </hlword>
              , телефон +7(4752) 71-55-55...
            </title>

Пытаюсь парсить его через Element Tree.

Получаю элемент title_elem = elem.find('title').
С помощью title_elem.itertext() я могу получить весь текст внутри тега.
Но мне нужно получить полностью весь title в виде строки (с разметкой).
Как это лучше сделать?

Отредактировано Zverushko (Янв. 23, 2016 15:24:45)

Офлайн

#2 Янв. 23, 2016 16:49:40

Zverushko
Зарегистрирован: 2013-04-22
Сообщения: 17
Репутация: +  0  -
Профиль   Отправить e-mail  

Парсинг xml

def get_hlword(elem):
    text = ''
    if elem.text:
        text += elem.text
    for hlword_elem in list(elem):
        if hlword_elem.text:
            text += '<hlword>' + hlword_elem.text + '</hlword>'
        if hlword_elem.tail:
            text += hlword_elem.tail
    return text

Офлайн

#3 Янв. 23, 2016 18:57:17

doza_and
От:
Зарегистрирован: 2010-08-15
Сообщения: 4138
Репутация: +  253  -
Профиль   Отправить e-mail  

Парсинг xml

думаю будет удобен https://pypi.python.org/pypi/xmltodict
http://docs.python-guide.org/en/latest/scenarios/xml/



Отредактировано doza_and (Янв. 23, 2016 18:58:47)

Офлайн

Board footer

Модераторировать

Powered by DjangoBB

Lo-Fi Version