• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • vbs
  • DOS/BAT
  • hta/htc
  • python
  • perl
  • VBA
  • ColdFusion
  • ruby
  • PowerShell
  • Lua
  • Golang
  • linux shell
您的位置:首页 > 脚本语言 >python > Python实现从脚本里运行scrapy的方法

Python实现从脚本里运行scrapy的方法

作者: 字体:[增加 减小] 来源:互联网

通过本文主要向大家介绍了python scrapy,python scrapy安装,scrapy python3,python scrapy教程,python scrapy下载等相关知识,希望对您有所帮助,也希望大家支持linkedu.com www.linkedu.com

本文实例讲述了Python实现从脚本里运行scrapy的方法。分享给大家供大家参考。具体如下:

import os
os.environ.setdefault('SCRAPY_SETTINGS_MODULE', 'project.settings') #Must be at the top before other imports
from scrapy import log, signals, project
from scrapy.xlib.pydispatch import dispatcher
from scrapy.conf import settings
from scrapy.crawler import CrawlerProcess
from multiprocessing import Process, Queue
class CrawlerScript():
    def __init__(self):
        self.crawler = CrawlerProcess(settings)
        if not hasattr(project, 'crawler'):
            self.crawler.install()
        self.crawler.configure()
        self.items = []
        dispatcher.connect(self._item_passed, signals.item_passed)
    def _item_passed(self, item):
        self.items.append(item)
    def _crawl(self, queue, spider_name):
        spider = self.crawler.spiders.create(spider_name)
        if spider:
            self.crawler.queue.append_spider(spider)
        self.crawler.start()
        self.crawler.stop()
        queue.put(self.items)
    def crawl(self, spider):
        queue = Queue()
        p = Process(target=self._crawl, args=(queue, spider,))
        p.start()
        p.join()
        return queue.get(True)
# Usage
if __name__ == "__main__":
    log.start()
    """
    This example runs spider1 and then spider2 three times.
    """
    items = list()
    crawler = CrawlerScript()
    items.append(crawler.crawl('spider1'))
    for i in range(3):
        items.append(crawler.crawl('spider2'))
    print items</div>

希望本文所述对大家的Python程序设计有所帮助。

</div>

您可能想查找下面的文章:

  • 使用Python的Scrapy框架十分钟爬取美女图
  • 使用Python的Scrapy框架十分钟爬取美女图
  • Python抓取框架 Scrapy的架构
  • Python使用Scrapy爬取妹子图
  • Python使用Scrapy爬取妹子图
  • 基于scrapy实现的简单蜘蛛采集程序
  • 使用Python的Scrapy框架编写web爬虫的简单示例
  • Python基于scrapy采集数据时使用代理服务器的方法
  • Python使用scrapy采集数据时为每个请求随机分配user-agent的方法
  • Python使用scrapy采集数据过程中放回下载过大页面的方法

相关文章

  • MySQL最常见的操作语句小结
  • Python通过递归遍历出集合中所有元素的方法
  • 详解python并发获取snmp信息及性能测试
  • python 实现插入排序算法
  • 在Mac OS上搭建Python的开发环境
  • Python GAE、Django导出Excel的方法
  • Python打印斐波拉契数列实例
  • python实现去除下载电影和电视剧文件名中的多余字符的方法
  • python正则表达式中的括号匹配问题
  • Python自定义进程池实例分析【生产者、消费者模型问题】

文章分类

  • vbs
  • DOS/BAT
  • hta/htc
  • python
  • perl
  • VBA
  • ColdFusion
  • ruby
  • PowerShell
  • Lua
  • Golang
  • linux shell

最近更新的内容

    • Python使用Paramiko模块编写脚本进行远程服务器操作
    • 使用Python的PIL模块来进行图片对比
    • Python中列表和元组的使用方法和区别详解
    • Django中模版的子目录与include标签的使用方法
    • 从零学Python之入门(五)缩进和选择
    • 详解Python 数据库 (sqlite3)应用
    • Python的时间模块datetime详解
    • Python编写电话薄实现增删改查功能
    • python的三目运算符和not in运算符使用示例
    • python编写简单爬虫资料汇总

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有