爬虫实战爬取58同城房源信息

当前位置博文首页 > 文章内容

最大化缩小

作者：栏目：未分类时间：2020-10-26 15:00:28

本站于2023年9月4日。收到“大连君*****咨询有限公司”通知
说我们IIS7站长博客，有一篇博文用了他们的图片。
要求我们给他们一张图片6000元。要不然法院告我们

为避免不必要的麻烦，IIS7站长博客，全站内容图片下架、并积极应诉
博文内容全部不再显示，请需要相关资讯的站长朋友到必应搜索。谢谢！

另祝：版权碰瓷诈骗团伙，早日弃暗投明。

相关新闻：借版权之名、行诈骗之实，周某因犯诈骗罪被判处有期徒刑十一年六个月

叹！百花齐放的时代,渐行渐远!

import requests from lxml import etree if __name__ == '__main__': #爬取到页面源码数据 url='https://su.58.com/ershoufang/' headers={ 'User-Agent':'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/86.0.4240.111 Safari/537.36' } page_text=requests.get(url=url,headers=headers).text tree=etree.HTML(page_text) #数据解析 #存储li标签对象 li_list=tree.xpath('//ul[@class="house-list-wrap"]/li') #这里class属性值应该是双引号 "" fp= open('./58.txt','w',encoding='utf-8') for li in li_list: #页面数据局部解析 title=li.xpath('./div[2]/p/span/text()')[0] print(title) fp.write(title+'\n')

立即下载 - IIS7 站长工具包

爬虫实战爬取58同城房源信息

作者： 栏目：未分类 时间：2020-10-26 15:00:28

作者：栏目：未分类时间：2020-10-26 15:00:28