HTTP协议是如何实现断点续传的?
现在大部分网络下载都有会断点续传的功能,尤其是在下载容量较大的文件的时候,断点续传功能可谓是必不可少的。那么断点续传功能是怎么实现的呢? 其实实现的原理很简单,就是在Http的请求上和一般的下载有所不同而已。 打个比方说,浏览器请求服务器上的一个文件时,发出的请求如下:假设服务器域名为wwww.codetc.com,文件名为down.zip。 GET /down.zip HTTP/1.1 Accept: image/gif, image/x-xbitmap, image/jpeg, image/pjpeg, application/vnd.ms-excel, application/msword, application/vnd.ms-powerpoint, */* Accept-Language: zh-cn Accept-Encoding: gzip, deflate User-Agent: Mozilla/4.0 (compatible; MSIE 5.01; Windows NT 5.0) Connection: Keep-Alive服务器收到请求后,会按要求寻找请求的文件,提取文件的信息,然后返回给浏览器,返回信息如下: 200 Content-Length=106786028 Accept-Ranges=bytes Date=Mon, 30 Apr 2001 12:56:11 GMT ETag=W/"02ca57e173c11:95b" Content-Type=application/octet-stream Server=Microsoft-IIS/5.0 Last-Modified=Mon, 30 Apr 2001 12:56:11 GMT通过返回的http协议状态码(200)我们可以知道浏览器请求的文件已经在服务器中找到,文件大小为106786028字节 如果是断点续传,我们就不是要从新下载整个文件,而是指定下载点,也就是说指定从该文件的多少字节的地方下载。所以在客户端浏览器传给Web服务器的时候要多加一条信息(从哪里开始下载)。下面是用自己编的一个"浏览器"来传递请求信息给Web服务器,要求从2000070字节开始下载,请求如下: GET /down.zip HTTP/1.0 User-Agent: NetFox RANGE: bytes=2000070- Accept: text/html, image/gif, image/jpeg, *; q=.2, */*; q=.2仔细看一下就会发现多了一行RANGE: bytes=2000070-这一行的意思就是告诉服务器下载down.zip这个文件是从2000070字节开始传,前面的字节不用传了。服务器收到这个请求以后,返回的信息如下: 206 Content-Length=106786028 Content-Range=bytes 2000070-106786027/106786028 Date=Mon, 30 Apr 2001 12:55:20 GMT ETag=W/"02ca57e173c11:95b" Content-Type=application/octet-stream Server=Microsoft-IIS/5.0 Last-Modified=Mon, 30 Apr 2001 12:55:20 GMT这个返回信息包和前面服务器返回的信息比较一下,就会发现增加了一行:Content-Range=bytes 2000070-106786027/106786028返回的代码也改为206了,而不再是200了。 其实断点续传的原理也就这样,知道了以上原理,就可以进行断点续传的编程了。
文章来源 CODETC,欢迎分享,转载请注明地址:
http://www.codetc.com/article-76-1.html
|