接口返回HTML页面详解
2023-12-15 18:59:11
import requests
from bs4 import BeautifulSoup
import re
import json
url = 'https://listado.mercadolibre.com.mx/hogar-muebles-jardin/cocina/almacenamiento-organizacion/organizadores-cocina/_CustId_570995983_PrCategId_AD'
# 添加 headers 和 cookies
headers = {
'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/119.0.0.0 Safari/537.36'
}
cookies = {
}
# 发起带有 headers 和 cookies 的 GET 请求
response = requests.get(url, headers=headers, cookies=cookies)
# 使用 BeautifulSoup 解析 HTML
soup = BeautifulSoup(response.text, 'html.parser')
# 找到包含 TOTAL_RESULTS 的标签
total_results_tag = soup.find('span', {'class': 'ui-search-search-result__quantity-results'})
# 获取 TOTAL_RESULTS 的文本内容
total_results_text = total_results_tag.text.strip()
print(total_results_text)
?首先,通过使用requests
库发送GET请求,添加了自定义的headers和cookies,以模拟浏览器访问。然后,使用BeautifulSoup
库对返回的HTML进行解析。
代码中使用了find
方法来找到类名为ui-search-search-result__quantity-results
的标签,该标签包含了搜索结果的总数量。然后,使用.text
属性获取该标签的文本内容,并使用strip()
方法去除多余的空白字符。
使用复制的进网站转换为python代码,选取url和headers和cookies参数
文章来源:https://blog.csdn.net/EaSoNgo111/article/details/135022534
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。 如若内容造成侵权/违法违规/事实不符,请联系我的编程经验分享网邮箱:veading@qq.com进行投诉反馈,一经查实,立即删除!
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。 如若内容造成侵权/违法违规/事实不符,请联系我的编程经验分享网邮箱:veading@qq.com进行投诉反馈,一经查实,立即删除!