dy播放量0.1元10000个相当于多少利用爬虫代码美女写真套图下载转PDF保存-本尊科技

利用爬虫代码美女写真套图下载转PDF保存

  发布时间:2025-11-08 05:14:17   作者:玩站小弟   我要评论
dy播放量0.1元10000个相当于多少利用爬虫代码美女写真套图下载转PDF保存爬的不是全站链接,该爬虫爬的是每套图的链接,相当于是详情页的链接需要单独下载的python库requestsfake_useragentxpathPIL下面有图片 打码是为了过审,这网站真的是正经的写 。

爬的利用不是全站链接 ,该爬虫爬的爬虫免费领取1000个快手赞是每套图的链接  ,相当于是代码香肠派对蓝莓辅助菜单详情页的链接

需要单独下载的python库

requests

fake_useragent

xpath

PIL

下面有图片 打码是为了过审 ,这网站真的美女香肠派对小宝直装公益是正经的写真网站不是什么老司机网站

import requests from fake_useragent import UserAgent from lxml import etree import os import aiohttp import asyncio from PIL import Image import shutil #获取详情页全部图片函数 async def get_xq(url): #计数 p=0 tasks = [] res = requests.get(url=url,headers=header) res.encoding="utf-8" res.close() tree = etree.HTML(res.text) #图片标题 imgtitle = tree.xpath(//title/text())[0] global title title = imgtitle #第一页的图片链接 img = tree.xpath(//article//img/@src) imgurl = ["https://www.xgyw01.co" + i for i in img] print("当前下载的套图标题:\n"+imgtitle) for i in imgurl: p += 1 tasks.append(down(i,imgtitle,p)) #获取下一页的链接 next = "https://www.xgyw01.co" + tree.xpath(//div[@class="pagination"][1]//a[last()]/@href)[0] #判断的条件 bool = tree.xpath(//div[@class="pagination"][1]//a[last()]/text())[0] #循环获取所有页 while True: print("正在获取"+next) if bool == "下一页" or bool == "下页": res = requests.get(url=next, headers=header) res.encoding = "utf-8" res.close() tree = etree.HTML(res.text) img = tree.xpath(//article//img/@src) imgurl = ["https://www.xgyw01.co" + i for i in img] for i in imgurl: p += 1 tasks.append(down(i,imgtitle,p)) #判断的条件 bool = tree.xpath(//div[@class="pagination"][1]//a[last()]/text())[0] if bool == "下一页" or 本尊科技bool == "下页": next = "https://www.xgyw01.co" + tree.xpath(//div[@class="pagination"][1]//a[last()]/@href)[0] continue else: break else: break print("开始异步下载图片.....") await asyncio.wait(tasks) #下载函数 async def down(url,filename,fn): filepath = os.path.join(dirdz,filename) if not os.path.exists(filepath): os.mkdir(filepath) async with aiohttp.ClientSession() as session: async with session.get(url) as res: with open(filepath+"/"+str(fn)+".jpg",mode="wb") as f: f.write(await res.content.read()) print(f"第{fn}张下载完成") #写真图片转PDF函数 def jpg_pdf(filename): # 定义文件夹路径和PDF文件名 folder_path = os.path.join(dirdz,filename) pdf_filename = os.path.join(dirdz,filename + ".pdf") # # 将JPEG文件转换为Pillow Image对象并添加到列表中 image_files = [os.path.join(folder_path, f) for f in os.listdir(folder_path) if f.endswith(.jpeg) or f.endswith(.jpg)] image_list = [] for file_path in image_files: img = Image.open(os.path.abspath(file_path)) image_list.append(img) # 找到所有JPEG文件 image_list[0].save(pdf_filename, "PDF" ,resolution=100.0, save_all=True, append_images=image_list[1:]) print("pdf合并完成,删除缓存的的图片") shutil.rmtree(folder_path) print("清理完成") #主函数 if __name__ == __main__: #定义的公共请求头 header = {"user-agent": UserAgent().random} #定义的保存路径(文件夹路径) dirdz = "这里输入保存的文件夹路径" #定义一个全局的标题保存文件名字 title = "" #爬取的网站是:https://www.xgyw01.co/,找到想下的写真下载比翼鸟内核免root套图直接点进去复制详情页的链接就行了 url = input("请输入套图详情页链接:") #使用异常捕获排除异常 try: #因为是异步函数所以需要用asyncio.run启动 asyncio.run(get_xq(url)) print(title) except: print("链接详情页解析错误.........") print("全部下载完成,开始生成pdf.......") #调用图片转PDF函数 jpg_pdf(title)

相关文章

  • 居留后台php+iapp源码

    源码介绍居留后台源码,下载源码之后,打开压缩包,把居留.zip解压出来,打开居留.zip压缩包,打开config.php文件,修改数据库账号密码,邮箱账号和授权码,支付商户id这些有易支付的可以填进去
    2025-11-08
  • 全搜小说

    全搜小说是一款资源丰富的小说阅读软件,支持用户在线导入书籍,解压文件,轻松阅读你感兴趣的小说,这里也提供了大量的小说资源,超多优质内容给你舒适的阅读体验,享受看小说带来的乐趣,还可以自定义阅读参数,轻
    2025-11-08
  • 中青遨游旅行

    中青遨游旅行可以为用户提供专业靠谱的旅游平台,为用户规划众多旅游线路,中青遨游旅行中支持专业的护航签证,帮助用户高效完成签证的办理,软件中还将为用户提供全球范围的旅游体验,为用户定制1对1个性化旅游线
    2025-11-08
  • 梦与城

    梦与城又名毒霸姬,这是一款ai聊天软件,这里提供了语言与文字互动功能,可以轻松回答你的各种问题,每时每刻陪伴着你,可以为你的方方面面提供帮助,为你出谋划策,还可以辅助用户轻松创作,让你文思泉涌,高效输
    2025-11-08
  • 火爆全网的ChatGPT小程序页面模板,让AI回答你的任何问题

    源码介绍:ChatGPT 是 OpenAI 开发的一款专门从事对话的人工智能聊天机器人原型。聊天机器人是一种大型语言模型,采用监督学习和强化学习技术。ChatGPT 于 2022 年 11 月推出,尽
    2025-11-08
  • Tapet随机壁纸

    Tapet随机壁纸能够为用户提供众多壁纸资源,让用户能够随机生成各种画风颜色的壁纸内容,用户能够轻松设置替换,Tapet随机壁纸中将不会占用过多的内存,为用户提供更加精美好看的随机壁纸,用户可以自由随
    2025-11-08

最新评论