10 2018 档案
Scrapy项目步骤
摘要:1:创建项目 scrapy startproject xxx 2:编写items.py文件 设置需要保存的数据字段 3:进入xxx.spiders 编写爬虫文件,文件里的name就是爬虫名(不同于项目名) 4:运行 scrapy crawl 爬虫名 scrapy crawl 爬虫名 -o json/ 阅读全文
posted @ 2018-10-27 09:52 简简单单的小神 阅读(147) 评论(0) 推荐(0)
Windows环境安装tesseract-ocr 4.00并配置环境变量
摘要:最近要做文字识别,不让直接用别人的接口,所以只能尝试去用开源的类库。tesseract-ocr是惠普公司开源的一个文字识别项目,通过它可以快速搭建图文识别系统,帮助我们开发出能识别图片的ocr系统。因为Windows环境开发,我也就必须在windows环境安装系统。 第一步:下载安装包 根据http 阅读全文
posted @ 2018-10-21 19:12 简简单单的小神 阅读(384) 评论(0) 推荐(0)