Найти - Пользователи
Полная версия: парсинг в BeautifulSoup
Начало » Python для новичков » парсинг в BeautifulSoup
1
Xokare228
Здравствуйте, столкнулся с проблемой. Есть кусок сайта:
 <ul class="download_ul">
    <li>
        <a href="ссылка 1" title="Высокое качество">HD 720 - 
            <span class="video_file_size">363 Мб</span>
        </a>
    </li>
    <li>
        <a href="ссылка 2" title="Хорошее качество">HQ 480 - 
            <span class="video_file_size">187 Мб</span>
        </a>
    </li>
    <li>
        <a href="ссылка 3" title="Среднее качество">SD 360 - 
            <span class="video_file_size">121 Мб</span>
        </a>
    </li>
    <li>
        <a href="ссылка 4" title="Мобильное качество">LQ 240 - 
            <span class="video_file_size">67 Мб</span>
        </a>
    </li>
</ul>
Нужно получить ссылку 1, как не пытался натравить BeautifulSoup ничего не получалось, подскажите как это правильно сделать
Romissevd
 from bs4 import BeautifulSoup
html = """<ul class="download_ul">
    <li>
        <a href="ссылка 1" title="Высокое качество">HD 720 -
            <span class="video_file_size">363 Мб</span>
        </a>
    </li>
    <li>
        <a href="ссылка 2" title="Хорошее качество">HQ 480 -
            <span class="video_file_size">187 Мб</span>
        </a>
    </li>
    <li>
        <a href="ссылка 3" title="Среднее качество">SD 360 -
            <span class="video_file_size">121 Мб</span>
        </a>
    </li>
    <li>
        <a href="ссылка 4" title="Мобильное качество">LQ 240 -
            <span class="video_file_size">67 Мб</span>
        </a>
    </li>
</ul>"""
soup = BeautifulSoup(html, "html.parser")
print(soup.select_one("li > a")["href"])
This is a "lo-fi" version of our main content. To view the full version with more information, formatting and images, please click here.
Powered by DjangoBB