Python爬虫入门【15】:煎蛋网XXOO图片抓取

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

今天写一个爬虫爱好者特别喜欢的网站煎蛋网http://jandan.net/ooxx,这个网站其实还是有点意思的,网站很多人写了N多的教程了,各种方式的都有,当然网站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用selenium在揍他一波。

整体看上去,煎蛋网的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。

1. 网站分析

这个网站如果用 selenium 爬取,其实也没什么要分析的,模拟访问就行,导入必备的模块。

from selenium import webdriver
from selenium.webdriver.common.by import By
from selenium.webdriver.support.ui import WebDriverWait
from selenium.webdriver.support import expected_conditions as EC
from lxml import etree
import requests

import time

我使用的是PhantomJS 去加载浏览器,关于这个PhantomJS,去互联网搜索一下吧,资料大把,会看的很爽的,总之呢,它可以模拟一个真实的浏览器做任何事情,得到你想要的数据。

browser = webdriver.PhantomJS()
browser.set_window_size(1366, 768)  # 这个地方需要设置一下浏览器的尺寸
wait = WebDriverWait(browser
python 爬取煎蛋ooxx妹子图 煎蛋妹子图首页(http://jandan.net/ooxx),这个链接看起来怎么那么邪恶呢?经分析站隐藏了图片地址。心一横,采取曲线路线,成功爬取大量妹子图~ 源码如下: 1 import requests 2 import re 3 import os 4 import base64 5 from urllib.request import urlretrieve... 阅读详情

相关推荐

[Python爬虫]煎蛋OOXX妹子图爬虫(1)——解密图片地址

之前在鱼C论坛的时候,看到很多人都在用Python爬虫煎蛋的妹子图,当时我也写过,爬了很多的妹子图片。后来煎蛋把妹子图的页改进了,对图片的地址进行了加密,所以论坛里面的人经常有人问怎么请求的页面没有链接。这篇文章就来说一下煎蛋OOXX妹子图的链接获取方式。 首先说明一下,之前煎蛋之所以增加了反爬虫机制,应该就是因为有太多的人去爬他们的站了。爬虫频繁的访问站会给站带来压力,所以,...

weixin_30725315的博客 1万+

×××站与***的秘密

CCTV央视在今晚的焦点访谈节目中播出了关于×××站与***病毒之间的利益链案件,称***病毒为×××站提供了暴利渠道。节目视频http://space.tv.cctv.com/video/VIDE1273061478337888淫秽×××站不仅直接传播淫秽×××信息,毒害青少年的身心健康,还往往与***病毒的制贩团伙相勾结,传播病毒、窃取信息以牟取暴利。在江苏省常...

weixin_34389926的博客 1万+

站Dos攻击

第一步 目的(攻击XXOO站)TMD太卡了!!! 找出 https://fczym.xyz/ 对应的服务器地址 目标站被攻击前截图 目标站攻击中截图 目标站完全挂逼截图 ping一下确认这个服务器 第二步 探测开放端口(SYN): SYN扫描: 使用SYN半开放扫描 发现开启了防火墙 TCP扫描: 扫描开放的TCP端口 第三步 破解服务器端口 扫描WEB敏感目录 (绕开鉴...

weixin_44162346的博客 3302

xxoo

time = input(‘请输入日期 YYYY-MM-DD:’) date = time.split(’-’) year = int(date[0]) month = int(date[1]) day = int(date[2]) li = [31,28,31,30,31,30,31,31,30,31,30,31] num = 0 if((year%40))and(year%100!=0)or(...

qq_45041558的博客 8万+

Python爬虫入门教程【15】:煎蛋XXOO图片抓取

今天写一个爬虫爱好者特别喜欢的煎蛋http://jandan.net/ooxx,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用selenium在揍他一波。 整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。 1. 站分析...

Python追梦 5127

Python煎蛋XXOO图片抓取

今天写一个爬虫爱好者特别喜欢的煎蛋http://jandan.net/ooxx,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用selenium在揍他一波。 整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。 1. 站分析...

Python追梦 7万+

Python爬虫入门煎蛋XXOO图片抓取

今天写一个爬虫爱好者特别喜欢的煎蛋 http://jandan.net/ooxx ,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用 selenium 在揍他一波。 整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。 ...

Pythoncxy的博客 1万+

Python爬虫入门教程 18-100 煎蛋XXOO图片抓取

写在前面 很高兴我这系列的文章写道第18篇了,今天写一个爬虫爱好者特别喜欢的煎蛋http://jandan.net/ooxx,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用selenium在揍他一波。 整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能...

weixin_30505043的博客 6631

图片站源码_Python爬虫入门煎蛋XXOO图片抓取

今天写一个爬虫爱好者特别喜欢的煎蛋 http://jandan.net/ooxx ,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用 selenium 在揍他一波。整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。1. 站...

weixin_39927861的博客 5049

小甲鱼python视频xxoo爬虫代码改进--煎蛋

2020/7/31 今天学习得是关于小甲鱼得python课程,根据这个课程也确确实实得学到了不少东西,所以希望大家也可以一起去学习 下面是我在小甲鱼上课改造之后得代码 这个课程是在b站上看的,号码是 av27789609 这个是第五十节左右得爬虫 ooxx 他的教学视频是很早的时候录得,现在的站进行了base64的加密等反爬措施,所以在原有的基础上需要进行修改 下面是我的代码,希望可以给大家一些启发,同时也希望大佬们给与指点。 import urllib.request import urllib

qq_45859272的博客 1万+

python爬虫相对路径src图片_Python爬虫入门教程第十八讲: 煎蛋XXOO图片抓取

今天写一个爬虫爱好者特别喜欢的煎蛋http://jandan.net/ooxx,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用selenium在揍他一波。整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。1. 站分析这个...

weixin_39870199的博客 1682

Python爬虫入门教程,突破煎蛋反爬措施,妹子图批量抓取

今天写一个爬虫爱好者特别喜欢的煎蛋 ,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用 selenium 在揍他一波。 整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫er,一批一批的奔赴上去的原因。 1. 站分析 这个站如果用 selenium 爬取,其实也没什么要分析的,模拟访问就行,导入必备的模块。 from sel...

python588的博客 579

Python下载煎蛋全站好看的姐妹的照片

春天到了,春光明媚,鸟语花香,各地都回温了!公园里面的花都开了,这几天都没有心情工作,准备周末出去游山玩水,踏踏青!先用Python爬取一波妹子图,摸摸鱼吧。 导入模块 首先把用到的模块贴进来。 import requests from bs4 import BeautifulSoup import time import random 抓取 煎蛋抓取流程:从第 101 页开始抓取,提取页面上的女装图片 url,请求 url 后保存图片,点击下一页,重复循环…。 当访问煎蛋的 http://jand

m0_59236548的博客 1万+

Python下载煎蛋全站好看的小姐姐!,Python面试必刷的200道真题

我们在看视频学习的时候,不能光动眼动脑不动手,比较科学的学习方法是在理解之后运用它们,这时候练手项目就很适合了,只是里面的项目比较多,水平也是参差不齐,大家可以挑自己能做的项目去练练。这是我花了几天的时间去把Python所有方向的技术点做的整理,形成各个领域的知识点汇总,它的用处就在于,你可以按照上面的知识点去找对应的学习资源,保证自己学得较为全面。煎蛋抓取流程:从第 101 页开始抓取,提取页面上的女装图片 url,请求 url 后保存图片,点击下一页,重复循环…页面的时候,它是显示的最后一页。

2401_83620959的博客 552

python爬虫——抓取煎蛋ooxx妹子图的一个小工具

一点学习成果,仅限学习交流! 一、部分源码: def get_page(html): # 获取下一页链接 start1 = str(html).find("Older Comments") stop1 = str(html).find("class", start1) url = "http:" + html[start1 + 22:stop1 - 2] ...

qiang086的博客 4343

Python爬虫入门教程 18-100 煎xXO图片抓取

很高兴我这系列的文章写道第18篇了,今天写一个爬虫爱好者特别喜欢的煎蛋http://jandan.net/ooxx,这个站其实还是有点意思的,站很多人写了N多的教程了,各种方式的都有,当然站本身在爬虫爱好者的不断进攻下,也在不断的完善,反爬措施也很多,今天我用selenium在揍他一波。 整体看上去,煎蛋的妹子图质量还是可以的,不是很多,但是还蛮有味道的,这可能也是爬虫e...

梦想橡皮擦,专栏100例写作模式先行者,现象级专栏 《Python 爬虫 100 例》作者、《滚雪球学 Python 专栏》原创者 7万+

Python下载煎蛋全站好看的小姐姐!(1),讲的真透彻

不知道你们用的什么环境,我一般都是用的Python3.6环境和pycharm解释器,没有软件,或者没有资料,没人解答问题,都可以免费领取(包括今天的代码),过几天我还会做个视频教程出来,有需要也可以领取~给大家准备的学习资料包括但不限于:Python 环境、pycharm编辑器/永久激活/翻译插件python 零基础视频教程Python 界面开发实战教程Python 爬虫实战教程Python 数据分析实战教程python 游戏开发实战教程Python 电子书100本。

2401_83620927的博客 865
上一篇: Python爬虫入门【14】:All IT eBooks多线程爬取
下一篇: Python爬虫入门【16】:链家租房数据抓取
未衬老师
博客等级 码龄7年 231粉丝 212原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值