• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >虚拟化 > Docker 部署Scrapy的详解

Docker 部署Scrapy的详解

作者:瓦力 字体:[增加 减小] 来源:互联网

本文主要包含Docker,部署Scrapy,Docker,Scrapy等服务器相关知识,瓦力 希望可以进行参考

假设我们要在10台Ubuntu 部署爬虫如何搞之?用传统的方法会吐血的,除非你记录下来每个步骤,然后步骤之间的次序还完全一样,这样才行。但是这样还是累啊,个别软件下载又需要时间。所以Docker出现了。Docker把系统,各种需要的应用,还有设置编译成一个image,然后 run一下就可以了。跟虚拟机的区别是不需要而外的物理支持,共用的。

1. 部署步骤

1.1 上传本地scrapy爬虫代码除了settings外到git 服务器

1.2 编写Dockerfile文件,把settings和requirements.txt 也拷贝到image里,一起打包成一个image

Dockerfile内容:

FROM ubuntu
RUN apt-get update
RUN apt-get install -y git
RUN apt-get install -y nano 
RUN apt-get install -y redis-server  
RUN apt-get -y dist-upgrade
RUN apt-get install -y openssh-server
RUN apt-get install -y python3.5 python3-pip
RUN apt-get install -y zlib1g-dev libffi-dev libssl-dev
RUN apt-get install -y libxml2-dev libxslt1-dev
RUN mkdir /code
WORKDIR /code
ADD ./requirements.txt /code/
ADD ./settings.py /code/
RUN mkdir /code/myspider
RUN pip3 install -r requirements.txt
VOLUME [ "/data" ]

requirements.txt 内容:

BeautifulSoup4
scrapy
setuptools
scrapy_redis
redis
sqlalchemy
pymysql
pillow

整个目录结构:

docker build -t fox6419/scrapy:scrapyTag .

fox6419是用户名,scrapyTag是tag

成功后,执行docker images可以在本地看到image

1.3 打包的image 上传到docker hub中

docker push username/repository:tag

push的命令格式是这样的,我这边就是:

docker push fox6419/scrapy:scrapyTag

1.4 在DigitalOcean这种主机商创建带docker应用的Ubuntu 16.04版本

1.5 登陆docker,拉下1.3的image,然后run起来

docker run -it fox6419/scrapy:scrapyTag /bin/bash

1.6 命令进去后,git clone 1.1中的爬虫,然后复制images里的settings到爬虫目录,然后执行scrapy crawl xxx即可

以上就是本文的全部内容,希望对大家的学习有所帮助,也希望大家多多支持。

您可能感兴趣的文章:

  • windows10系统中安装python3.x+scrapy教程
  • python使用scrapy发送post请求的坑
  • Python爬虫框架scrapy实现downloader_middleware设置proxy代理功能示例
  • Python爬虫框架scrapy实现的文件下载功能示例
  • Python爬虫框架Scrapy常用命令总结
  • 详解Python安装scrapy的正确姿势
  • Scrapy基于selenium结合爬取淘宝的实例讲解
  • 利用Anaconda简单安装scrapy框架的方法
  • 基于scrapy的redis安装和配置方法
  • mac下给python3安装requests库和scrapy库的实例
  • 利用scrapy将爬到的数据保存到mysql(防止重复)
  • Centos7 Python3下安装scrapy的详细步骤
  • Windows下安装Scrapy
分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • Docker实践8:Compose,docker实践compose
  • Docker buildx构建多平台镜像并推送到私有仓库的方法
  • Docker三个基本概念镜像(Image)容器(Container)仓库(Repository)
  • 什么是Docker?为什么要使用Docker
  • docker 开源的应用容器引擎
  • 如何给docker设置http代理
  • docker官方mysql镜像自定义配置详解
  • 详解Docker数据管理(数据卷&数据卷容器)
  • 如何利用Docker容器实现代理转发与数据备份详解
  • 详解Docker Swarm 在持续集成测试中的应用

相关文章

  • Dockerfile中CMD和ENTRYPOINT命令详解
  • Docker容器自启动的实现方法
  • 什么是docker Docker入门教程第一篇
  • Docker设置代理的方法教程
  • Docker 搭建私有仓库(registry、harbor)
  • docker centos7 安装ssh具体步骤
  • docker images 如何建立自己的原生镜像
  • 详解docker容器硬盘动态扩容
  • 谷歌技术人员解决Docker镜像体积太大问题的方法
  • 常用的Docker基本命令及用法汇总

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • VMware Tools(ubuntu系统)安装图文教程
    • openstack pike单机一键安装shell的方法
    • Centos7上安装docker的方法
    • 详解Docker方式实现MySql 主从复制(实践篇)
    • Docker容器中文乱码(修改docker容器编码格式)的解决方案
    • 什么是Docker? Docker入门教程
    • 详解Ubuntu Docker Registry 搭建私有仓库
    • hadoop动态增加和删除节点方法介绍
    • vitualbox虚拟机安装centos 7 及ssh访问、自启动等配置方法
    • docker守护进程的配置和操作的方法

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有