thinkphp 抓取网站的内容并且保存到本地的实例详解-6ren

thinkphp 抓取网站的内容并且保存到本地的实例详解

转载作者：qq735679552 更新时间：2022-09-28 22:32:09

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章thinkphp 抓取网站的内容并且保存到本地的实例详解由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

thinkphp 抓取网站的内容并且保存到本地的实例详解。

我需要写这么一个例子，到电子课本网下载一本电子书.

电子课本网的电子书，是把书的每一页当成一个图片，然后一本书就是有很多张图片，我需要批量的进行下载图片操作.

下面是代码部分:

 
    ? 
   
         public 
         function 
         download() { 
        
         $http 
         =  
         new 
         \Org\Net\Http(); 
        
         $url_pref 
         =  
         "http://www.dzkbw.com/books/rjb/dili/xc7s/" 
         ; 
        
         $localUrl 
         =  
         "Public/bookcover/" 
         ; 
        
         $reg 
         = 
         "|showImg\('(.+)'\);|" 
         ; 
        
         $i 
         =1; 
        
         do 
         { 
        
         $filename 
         =  
         substr 
         ( 
         "000" 
         . 
         $i 
         ,-3). 
         ".htm" 
         ; 
        
         $ch 
         = curl_init(); 
        
         curl_setopt( 
         $ch 
         , CURLOPT_URL,  
         $url_pref 
         . 
         $filename 
         ); 
        
         curl_setopt( 
         $ch 
         , CURLOPT_RETURNTRANSFER, 1); 
        
         curl_setopt( 
         $ch 
         , CURLOPT_CONNECTTIMEOUT, 10); 
        
         curl_setopt( 
         $ch 
         , CURLOPT_FOLLOWLOCATION, 1); 
        
         $html 
         = curl_exec( 
         $ch 
         ); 
        
         curl_close( 
         $ch 
         ); 
        
         $result 
         = preg_match_all( 
         $reg 
         , 
         $html 
         , 
         $out 
         , PREG_PATTERN_ORDER); 
        
         if 
         ( 
         $result 
         ==1) { 
        
         $picUrl 
         =  
         $out 
         [1][0]; 
        
         $picFilename 
         =  
         substr 
         ( 
         "000" 
         . 
         $i 
         ,-3). 
         ".jpg" 
         ; 
        
         $http 
         ->curlDownload( 
         $picUrl 
         ,  
         $localUrl 
         . 
         $picFilename 
         ); 
        
         } 
        
         $i 
         =  
         $i 
         +1; 
        
         }  
         while 
         ( 
         $result 
         ==1); 
        
         echo 
         "下载完成" 
         ; 
        
         }

我这里是以人教版地理七年级地理上册为例子 http://www.dzkbw.com/books/rjb/dili/xc7s/001.htm 。

网页是从001.htm开始，然后数字一直加。

每个网页里面都有一张图，就是对应课本的内容，以图片的形式展示课本内容。

我的代码是做了一个循环，从第一页开始抓，一直抓到找不到网页里的图片为止。

抓到网页的内容后，把网页里面的图片抓取到本地服务器。

抓取后的实际效果:

thinkphp 抓取网站的内容并且保存到本地的实例详解

以上就是thinkphp 抓取网站的内容并且保存到本地的实例详解，如有疑问请留言或者到本站社区交流讨论，感谢阅读，希望能帮助到大家，谢谢大家对本站的支持！。

原文链接：http://www.cnblogs.com/modou/p/5991617.html 。

最后此篇关于thinkphp 抓取网站的内容并且保存到本地的实例详解的文章就讲到这里了,如果你想了解更多关于thinkphp 抓取网站的内容并且保存到本地的实例详解的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

文章推荐： pandas 按日期范围筛选数据的实现

文章推荐：浅谈 javascript 事件处理

文章推荐：基于Python-Pycharm实现的猴子摘桃小游戏(源代码)

文章推荐： Yii2.0小部件GridView(两表联查/搜索/分页)功能的实现代码

jstat 详解
全称“Java Virtual Machine statistics monitoring tool”（statistics 统计；monitoring 监控；tool 工具）用于监控虚拟机的各种运
MongoDB索引操作和执行计划Explain()详解
主要是讲下Mongodb的索引的查看、创建、删除、类型说明，还有就是Explain执行计划的解释说明。可以转载，但请注明出处。
Linux下几种并发服务器的实现模式(详解)
1>单线程或者单进程相当于短链接，当accept之后，就开始数据的接收和数据的发送，不接受新的连接，即一个server，一个client 不存在并发。 2>循环服务器和并发服务器
详解 Linux中的关机和重启命令
详解 linux中的关机和重启命令一 shutdown命令 shutdown [选项] 时间选项： ?
用Newtonsoft将json串转为对象的方法(详解)
首先，将json串转为一个JObject对象： ? 1
Python画图常用命令大全(详解)
matplotlib官网 matplotlib库默认英文字体添加黑体（‘SimHei'）为绘图字体代码： plt.rcParams['font.sans-serif']=['SimHei'
Java中的关键字synchronized 详解
在并发编程中，synchronized关键字是常出现的角色。之前我们都称呼synchronized关键字为重量锁，但是在jdk1.6中对synchronized进行了优化，引入了偏向锁、轻量锁。本篇
详解.NET数据库连接池
一般我们的项目中会使用1到2个数据库连接配置，同程艺龙的数据库连接配置被收拢到统一的配置中心，由DBA统一配置和维护，业务方通过某个字符串配置拿到的是Connection对象。
linux下gettimeofday函数windows替换方法(详解)
实例如下： ? 1
详解.Net缓存之MemoryCahe
1. MemoryCahe NetCore中的缓存和System.Runtime.Caching很相似，但是在功能上做了增强，缓存的key支持object类型；提供了泛型支持；可以读缓存和单个缓存
Javascript基础教程之argument 详解
argument是javascript中函数的一个特殊参数，例如下文，利用argument访问函数参数，判断函数是否执行复制代码代码如下: <script
linux中了minerd之后的完全清理过程(详解)
一不小心装了一个Redis服务，开了一个全网的默认端口，一开始以为这台服务器没有公网ip，结果发现之后悔之莫及啊某天发现cpu load高的出奇，发现一个minerd进程占了大量cpu，googl
基于php编程规范(详解)
今天写这个是为了提醒自己编程过程不仅要有逻辑思想还有要规范代码这样可读性 1、PHP 编程规范与编码习惯最主要的有以下几点： 1 文件说明 2 funct
使用yum查看工具lspci所在包并安装的方法(详解)
摘要：虚拟机安装时一般都采用最小化安装，默认没有lspci工具。一台测试虚拟网卡性能的虚拟机，需要lspci工具来查看网卡的类型。本文描述了在一个虚拟机中安装lspci工具的具体步骤。由于要测试
Linux下高并发socket最大连接数所受的各种限制(详解)
1、修改用户进程可打开文件数限制在Linux平台上，无论编写客户端程序还是服务端程序，在进行高并发TCP连接处理时，最高的并发数量都要受到系统对用户单一进程同时可打开文件数量的限制(这是因为系统
一篇文章带你入门java运算符(详解)
目录算术运算符基本四则运算符增量赋值运算符自增/自减运算符关系运算符逻
PHP面向对象之事务脚本模式(详解)
如下所示： ? 1
详解 MapperScannerConfigurer之sqlSessionFactory注入方式
MapperScannerConfigurer之sqlSessionFactory注入方式讲解首先，Mybatis中的有一段配置非常方便，省去我们去写DaoImpl（Dao层实现类）的时间，这个
详解：Linux网络虚拟化技术
Linux的网络虚拟化是LXC项目中的一个子项目，LXC包括文件系统虚拟化，进程空间虚拟化，用户虚拟化，网络虚拟化，等等，这里使用LXC的网络虚拟化来模拟多个网络环境。本文从基本的网络设备讲
highchart数据源纵轴json内的值必须是int(详解)
? 1

qq735679552

个人简介

我是一名优秀的程序员,十分优秀！

作者热门文章

滴滴打车优惠券免费领取

全站热门文章

首页

博学

6Ren·AI

商城

thinkphp 抓取网站的内容并且保存到本地的实例详解