一：简介

通过selenium模块，模拟火狐浏览器进行搜索下载操作。

二：脚本内容

# -*- coding:utf-8 -*-

# 百度图片自动爬去

# Chrome浏览器类似，设置其options：

# download.default_directory：设置下载路径

# profile.default_content_settings.popups：设置为 0 禁止弹出窗口

import time

from selenium import webdriver

# 创建一个浏览器的profile文件

profile = webdriver.FirefoxProfile()

# 指定下载路径

profile.set_preference('browser.download.dir',"D:\\images")

# 设置成 2 表示使用自定义下载路径；设置成 0 表示下载到桌面；设置成 1 表示下载到默认路径

profile.set_preference('browser.download.folderList', 2)

# 是否弹出下载管理器

profile.set_preference('browser.download.manager.showWhenStarting', False)

# 指定下载文件的数据类型

profile.set_preference('browser.helperApps.neverAsk.saveToDisk','image/jpeg, image/png')

# 打开火狐浏览器，并指定profile文件

firfox = webdriver.Firefox(firefox_profile=profile)

# 访问百度

firfox.get("http://www.baidu.com")

# 清除百度搜索框，元素id为f12查看

firfox.find_element_by_id("kw").clear()

# 发送内容到搜索框

firfox.find_element_by_id("kw").send_keys(u"美女")

time.sleep(2)

# 点击百度一下按钮

firfox.find_element_by_id("su").click()

time.sleep(5)

# 对当前页面进行定位（不一定生效）

firfox.current_window_handle

# 根据xpath定位

firfox.find_element_by_xpath("//*[@id=\"s_tab\"]/a[5]").click()

time.sleep(3)

firfox.current_window_handle

# 根据xpath定位

firfox.find_element_by_xpath("//*[@id=\"imgid\"]/div/ul/li[1]/div[1]/a/img").click()

time.sleep(3)

# 加载当前页面的元素

firfox.switch_to_window(firfox.window_handles[1])

while True:

    #firfox.find_element_by_xpath("//html/body/div[1]/div[2]/div/div[2]/div/div[1]/span[7]").click()

    # 根据class进行定位，也就是点击下载按钮

    firfox.find_element_by_class_name(r"bar-btn.btn-download").click()

    time.sleep(10)

    # 切换图片

    firfox.find_element_by_xpath("//*[@id=\"container\"]/span[2]").click()

    time.sleep(10)

firfox.quit()

selenium爬取百度图片的更多相关文章

selenium+chrome浏览器驱动-爬取百度图片
百度图片网页中中,当页面滚动到底部,页面会加载新的内容. 我们通过selenium和谷歌浏览器驱动,执行js,是浏览器不断加载页面,通过抓取页面的图片路径来下载图片. from selenium im ...
百度图片爬虫-python版-如何爬取百度图片&quest;
上一篇我写了如何爬取百度网盘的爬虫,在这里还是重温一下,把链接附上: http://www.cnblogs.com/huangxie/p/5473273.html 这一篇我想写写如何爬取百度图片的爬虫 ...
python 3 爬取百度图片
python 3 爬取百度图片学习了:https://blog.csdn.net/X_JS612/article/details/78149627
Python 爬虫实例（1）—— 爬取百度图片
爬取百度图片在Python 2.7上运行 #!/usr/bin/env python # -*- coding: utf-8 -*- # @Author: loveNight import jso ...
python爬虫-爬取百度图片
python爬虫-爬取百度图片(转) #!/usr/bin/python# coding=utf-8# 作者 :Y0010026# 创建时间 :2018/12/16 16:16# 文件 :spider ...
python 利用selenium爬取百度文库的word文章
今天学习如何使用selenium库来爬取百度文库里面的收费的word文档 from selenium import webdriver from selenium.webdriver.common.k ...
Python爬虫：通过关键字爬取百度图片
使用工具:Python2.7 点我下载 scrapy框架 sublime text3 一.搭建python(Windows版本) 1.安装python2.7 ---然后在cmd当中输入python,界 ...
python爬虫之爬取百度图片
##author:wuhao##爬取指定页码的图片,如果需要爬取某一类的所有图片,整体框架不变,但需要另作分析#import urllib.requestimport urllib.parseimpo ...
Java爬取百度图片Google图片Bing图片
先看看抓取的结果. 8个Java类: Startup.java - main函数 ImageCrawler.java - Crawler基类 BaiduImageCrawler.java - 百度图片 ...

随机推荐

mysql给数据库授权 GRANT ALL PRIVILEGES ON
mysql> grant 权限1,权限2,…权限n on 数据库名称.表名称 to 用户名@用户地址 identified by ‘连接口令’; show grants for mustang@ ...
SPSS与聚类分析
1.进行K均值聚类分析时需要线标准化处理,抛弃量纲差异,比如说数值型变量有的以千记有的以百分数记.2.层次聚类就是先把每个样本都看成一个独立的类:聚类特征(Clustering Feature, CF ...
ARM简介(科普文)
ARM简介[1] 1. ARM只卖知识产权,不卖(物理的,实质的)产品. 全世界100多家公司购买了ARM授权,包括三星,Freescale.NXP Semiconductors.STMicro ...
梅安森元图地图开放平台、专业GIS地图平台
元图地图开放平台:http://map.cmetamap.com/?from=groupmessage 梅安森元图地图开放平台: 自主知识产权,专业GIS地图平台,用简单语言即可轻松操作复杂的互联网地 ...
Oracle EBS OM 主要API示例
1, Book order Oe_Order_Pub.Process_Order ( 1 , Fnd_Api.G_FALSE , Fnd_Api.G_FALSE , Fnd_Api.G_FALSE , ...
Python3实现ICMP远控后门(下)之&OpenCurlyDoubleQuote;Boss”出场
ICMP后门前言第一篇:Python3实现ICMP远控后门(上) 第二篇:Python3实现ICMP远控后门(上)_补充篇第三篇:Python3实现ICMP远控后门(中)之"嗅探&qu ...
九&period;LNMP网站架构实践部署
期中集群架构-第九章-期中架构LNMP章节====================================================================== 01. LNMP ...
java&period;net&period;UnknownHostException&colon; master
1:如果你报这个错误,第一反应应该是本地的host文件没有配置服务器名称和对应的ip地址,这个反应就对了.贴一下错误和解决方法: java.net.UnknownHostException: mast ...
Linux中&OpenCurlyDoubleQuote;零拷贝”
服务器响应一个http请求的步骤把磁盘文件读入内核缓冲区从内核缓冲区读到内存处理(静态资源不需处理) 发送到网卡的内核缓冲区(发送缓存) 网卡发送数据数据从第一步中的内核缓冲区到第四步的内核缓 ...
python 中关于descriptor的一些知识问题
这个问题从早上日常扫segmentfault上问题开始有个问题是 class C(object): @classmethod def m(): pass m()是类方法,调用代码如下: C.m() ...