博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
Python爬虫工具篇 - 必会用的6款Chrome插件
阅读量:2381 次
发布时间:2019-05-10

本文共 1044 字,大约阅读时间需要 3 分钟。

在日常 PC 端的Python爬虫过程工作中,Chrome 浏览器是我们常用的一款工具。

鉴于 Chrome 浏览器的强大,Chrome 网上应用商店很多强大的插件可以帮助我们快速高效地进行数据爬虫。

今天推荐的 6 款 Chrome 插件,可以大大提升我们的爬虫效率。

EditThisCookie

EditThisCookie 是一个 Cookie 管理器,可以很方便的添加,删除,编辑,搜索,锁定和屏蔽 Cookies。

可以将登录后的 Cookies 先保存到本地,借助 cookielib 库,直接爬取登录后的数据。

避免了抓包和模拟登录,帮助我们快速地进行爬虫。

Web Scraper

Web Scraper 是一款免费的、适用于任何人,包含没有任何编程基础的爬虫工具。

操作简单,只需要鼠标点击和简单的配置,就能快速的爬取 Web 端的数据。它支持复杂的网站结构,数据支持文本、连接、数据块、下拉加载数据块等各种数据类型。

此外,还能将爬取的数据导出到 CSV 文件中。

Xpath Helper

Xpath Helper 是一种结构化网页元素选择器,支持列表和单节点数据获取,

它可以快速地定位网页元素。

对比 Beautiful Soup,由于 Xpath 网页元素查找性能更有优势;Xpath 相比正则表达式编写起来更方便。

编写 Xpath 之后会实时显示匹配的数目和对应的位置,方便我们判断语句是否编写正确。

Toggle JavaScript

Toggle JavaScript 插件可以用来检测当前网页哪些元素是通过 AJAX 动态加载的。

使用它可以快速在容许加载 JS 、禁止加载 JS 两种模式中切换。

User-Agent Switcher for Chrome

User-Agent Switcher for Chrome 插件可以很方便的修改浏览器的 User-Agent。

可以模拟不同的浏览器、客户端,包含 Android、IOS 去模拟请求。

对于一些特殊网站,切换 User-Agent 可以更方便地进行数据爬取。

JSON-handle

JSON-handle 是一款功能强大的 JSON 数据解析 Chrome 插件。

它以简单清晰的树形图样式展现 JSON 文档,并可实时编辑。

针对数据量大的场景,可以做局部选取分析。

关于Chrome插件的分享先到这里啦!伙伴们有补充的欢迎留言哦!更多的Python相关知识也会继续为大家分享!

转载地址:http://lekab.baihongyu.com/

你可能感兴趣的文章
ttserver 缓存使用和过期设置
查看>>
php pconnect 长连接原理
查看>>
php memcached使用中的坑
查看>>
php变量引用和计数_refcount_gc和is_ref_gc
查看>>
windows环境下php和Php扩展编译,扩展dll文件编译
查看>>
magento 验证码
查看>>
magento 获取自定义产品属性和属性值
查看>>
magento获取产品的好评率
查看>>
magento 获取产品的销售量
查看>>
magento缓存系列详解:clean cache
查看>>
magento缓存系列详解:如何缓存一个block
查看>>
magento性能优化系列二:db篇
查看>>
去除firefox点击链接时的虚线边框
查看>>
php中截取中文字符串
查看>>
magento 通过属性获取产品
查看>>
php数组和对象的值传递和引用传递
查看>>
div 垂直居中对齐方法收集
查看>>
php curl请求信息和返回信息
查看>>
JavaScript importScripts 之实现和用法
查看>>
html5 web worker 和serverSend使用
查看>>