MCPcopy Create free account

hub / github.com/54xingzhe/weixin_crawler / types & classes

Types & classes35 in github.com/54xingzhe/weixin_crawler

↓ 15 callersClassDBQ
持久型数据库队列维护, 一条记录通常是一个类别, 类别中有一个list用户维护该类别的成员 类别的主要属性是meta和data 所有DBQ均在同一个collection中 一个DBQ就是一条记录 一个DBQ实例在数据库中queue为一条记录
project/tools/data_queue.py:98
↓ 5 callersClassRequest
source_code/request/__init__.py:17
↓ 2 callersClassWeixinDB
针对微信全部数据提供方法 暴露给全部程序可见
project/db/__init__.py:153
↓ 1 callersClassCrawlArticleItem
project/crawler/crawler/items/crawl_article.py:4
↓ 1 callersClassCrawlArticleReadDataItem
project/crawler/crawler/items/crawl_article.py:10
↓ 1 callersClassCustomFlask
project/ui/ui_instance.py:9
↓ 1 callersClassGZH
解析从数据库中直接得到的公众号原始数据 组织数据方便后续公众号报告中使用
project/Application/report/gzh_report/GZH.py:4
↓ 1 callersClassGZHCategory
管理公众号分类 接受前端的消息对对数据进行组织并反馈结果给前端
project/Application/gzh_category/__init__.py:6
↓ 1 callersClassGZHCrawler
只有一个实例对象,在设计模式中可以采用单例模式 接受一个公众号爬虫管理者实例作为参数
project/Application/gzh_crawler/__init__.py:6
↓ 1 callersClassGZHReportData
产生公众号报告所需要的数据
project/Application/report/gzh_report/__init__.py:8
↓ 1 callersClassGZHSearch
管理所有公众号在ES中的index和doc
project/es/__init__.py:13
↓ 1 callersClassGZHSearchSetting
公众号搜索设置服务 和前端设置面板进行交互, 为执行搜索时提供设置参数
project/es/setting.py:6
↓ 1 callersClassLoadMoreItem
project/crawler/crawler/items/load_more.py:4
↓ 1 callersClassOperateAllPhone
同时控制给定abd端口的所有手机 请确保手机初始界面一致
project/phone_operate/PhoneControl.py:114
↓ 1 callersClassPhoneControl
project/phone_operate/PhoneControl.py:18
↓ 1 callersClassRQ
使用redis创建一个队列FIFO
project/tools/data_queue.py:13
↓ 1 callersClassVC
根据给定的文字或位置信息执行屏幕点击动作 click_by_loc和click_by_words是最重要的连个对外接口
project/phone_operate/VC.py:6
↓ 1 callersClassWeixinOperate
实现对所有在线手机进行操作 以获取微信请求参数
project/phone_operate/WeixinOperate.py:12
ClassArticleListSpider
project/crawler/crawler/spiders/article_list.py:9
ClassArticleReadDataMiddleware
project/crawler/crawler/middlewares/crawl_article.py:55
ClassArticleReadDataSpider
公众号文章阅读数据爬虫
project/crawler/crawler/spiders/article.py:89
ClassArticleSpider
公众号文章内容爬虫
project/crawler/crawler/spiders/article.py:12
ClassBase
`Base`类是所有图形类的基类,提供部分初始化参数和基本的方法
source_code/base.py:19
ClassCrawlArticleMiddleware
project/crawler/crawler/middlewares/crawl_article.py:11
ClassDecodeArticle
解析文章内容
project/crawler_assist/decode_response.py:16
ClassDecodeArticleList
解析获取文章列表
project/crawler_assist/decode_response.py:61
ClassLoadMoreMiddleware
project/crawler/crawler/middlewares/load_more.py:7
ClassMultiTask
project/tools/MultiTask.py:13
ClassOCR
project/phone_operate/OCR.py:12
ClassResponse
source_code/response/__init__.py:17
ClassResponseArticleListPipeline
project/crawler/crawler/pipelines/load_more.py:5
ClassResponseArticlePipeline
project/crawler/crawler/pipelines/crawl_article.py:5
ClassResponseArticleReadDataPipeline
project/crawler/crawler/pipelines/crawl_article.py:23
ClassSingleton
抽象单例
project/tools/dp.py:1
ClassTidyReqData
anyproxy直接将截取的请求数据存放在redis中TidyReqData提供方法整理出每个手机的最新请求文件 并且删除历史请求文件
project/crawler_assist/tidy_req_data.py:8