curl下载 Linux必备下载命令之curl详解
- 跳转官网下载下载点击免费下载
一、curl的用法
curl是一个利用URL语法在命令行方式下工作的文件传输工具。本文介绍了它的简单用法。
*******************************************************************************************************************************************************
curl是一个利用URL语法在命令行方式下工作的文件传输工具。
它支持很多协议:FTP, FTPS, HTTP, HTTPS, GOPHER, TELNET, DICT, FILE以及 LDAP。
curl同样支持HTTPS认证,HTTP POST方法, HTTP PUT方法, FTP上传, kerberos认证, HTTP上传,代理服务器, cookies,用户名/密码认证,下载文件断点续传,上载文件断点续传, http代理服务器管道( proxy tunneling),甚至它还支持IPv6, socks5代理服务器,通过http代理服务器上传文件到FTP服务器等等,功能十分强大。
Windows操作系统下的网络蚂蚁,网际快车(FlashGet)的功能它都可以做到。准确的说,curl支持文件的上传和下载,所以是一个综合传输工具,但是按照传统,用户习惯称curl为下载工具。
curl是瑞典curl组织开发的,您可以访问:
获取它的源代码和相关说明。
鉴于curl在Linux上的广泛使用,IBM在AIX Linux Toolbox的光盘中包含了这个软件,并且您可以访问IBM网站:
1.ibm.com/servers/aix/products/aixos/linux/altlic.html下载它。
curl的最新版本是 7.10.8,IBM网站上提供的版本为7.9.3。
在AIX下的安装很简单,IBM网站上下载的rpm格式的包。
在 ,您可以下载到UNIX格式的man帮助,里面有详细的curl工具的使用说明。
curl的用法为:curl [options] [URL...]
其中options是下载需要的参数,大约有80多个,curl的各个功能完全是依靠这些参数完成的。
具体参数的使用,用户可以参考curl的man帮助。
下面,本文就将结合具体的例子来说明怎样利用curl进行下载。
1、获得一张页面
使用命令:curl
这是最简单的使用方法。用这个命令获得了指向的页面,同样,如果这里的URL指向的是一个文件或者一幅图都可以直接下载到本地。如果下载的是HTML文档,那么缺省的将不显示文件头部,即HTML文档的header。要全部显示,请加参数-i,要只显示头部,用参数-I。任何时候,可以使用-v命令看curl是怎样工作的,它向服务器发送的所有命令都会显示出来。为了断点续传,可以使用-r参数来指定传输范围。
2、表单(Form)的获取
在WEB页面设计中,form是很重要的元素。Form通常用来收集并向网站提交信息。提交信息的方法有两种,GET方法和POST方法。先讨论GET方法,例如在页面中有这样一段:
<form method="GET" action="junk.cgi">
<input type=text name="birthyear">
<input type=submit name=press value="OK">
</form>
那么浏览器上会出现一个文本框和一个标为“OK”的按钮。按下这个按钮,表单就用GET方法向服务器提交文本框的数据。
例如原始页面是在 www.hotmail.com/when/birth.html看到的,然后您在文本框中输入1905,然后按OK按钮,那么浏览器的URL现在应该是:“www.hotmail.com/when/junk.cgi?birthyear=1905&;press=OK”
对于这种网页,curl可以直接处理,例如想获取上面的网页,只要输入:
curl"www.hotmail.com/when/junk.cgi?birthyear=1905&;press=OK"
就可以了。
表单用来提交信息的第二种方法叫做POST方法,POST方法和GET方法的区别在于GET方法使用的时候,浏览器中会产生目标URL,而POST不会。类似GET,这里有一个网页:
<form method="POST" action="junk.cgi">
<input type=text name="birthyear">
<input type=submit name=press value="OK">
</form>
浏览器上也会出现一个文本框和一个标为“OK”的按钮。按下这个按钮,表单用POST方法向服务器提交数据。
这时的URL是看不到的,因此需要使用特殊的方法来抓取这个页面:
curl-d"birthyear=1905&press=OK" www.hotmail.com/when/junk.cgi
这个命令就可以做到。
1995年年末,RFC 1867定义了一种新的POST方法,用来上传文件。主要用于把本地文件上传到服务器。此时页面是这样写的:
<form method="POST" enctype='multipart/form-data' action="upload.cgi">
<input type=file name=upload>
<input type=submit name=press value="OK">
</form>
对于这种页面,curl的用法不同:
curl-F upload=@localfilename-F press=OK URL
这个命令的实质是将本地的文件用POST上传到服务器。
有关POST还有不少用法,用户可以自己摸索。
3、使用PUT方法。
HTTP协议文件上传的标准方法是使用PUT,此时curl命令使用-T参数:
curl-T uploadfile www.uploadhttp.com/receive.cgi
4、有关认证。
curl可以处理各种情况的认证页面,例如下载用户名/密码认证方式的页面(在IE中通常是出现一个输入用户名和密码的输入框):
curl-u name:password www.secrets.com
如果网络是通过http代理服务器出去的,而代理服务器需要用户名和密码,那么输入:
curl-U proxyuser:proxypassword
任何需要输入用户名和密码的时候,只在参数中指定用户名而空着密码,curl可以交互式的让用户输入密码。
5、引用。
有些网络资源访问的时候必须经过另外一个网络地址跳转过去,这用术语来说是:referer,引用。
对于这种地址的资源,curl也可以下载:
curl-e daniel.haxx.se
6、指定用户客户端。
有些网络资源首先需要判断用户使用的是什么浏览器,符合标准了才能够下载或者浏览。
此时curl可以把自己“伪装”成任何其他浏览器:
curl-A"Mozilla/4.0(compatible; MSIE 5.01; Windows NT 5.0)" URL
这个指令表示curl伪装成了IE5.0,用户平台是Windows 2000。(对方服务器是根据这个字串来判断客户端的类型的,所以即使使用AIX也无所谓)。
使用:
curl-A"Mozilla/4.73 [en](X11; U; Linux 2.2.15 i686)" URL
此时curl变成了Netscape,运行在PIII平台的Linux上了。
7、COOKIES
Cookie是服务器经常使用的一种记忆客户信息的方法。如果cookie被记录在了文件中,那么使用命令:
curl-b stored_cookies_in_file www.cookiesite.com
curl可以根据旧的cookie写出新cookie并发送到网站:
curl-b cookies.txt-c newcookies.txt www.cookiesite.com
8、加密的HTTP——HTTPS。
如果是通过OpenSSL加密的https协议传输的网页,curl可以直接访问:
curl
9、http认证。
如果是采用证书认证的http地址,证书在本地,那么curl这样使用:
curl-E mycert.pem
参考读物和注意事项:
curl非常博大,用户要想使用好这个工具,除了详细学习参数之外,还需要深刻理解http的各种协议与URL的各个语法。
这里推荐几个读物:
RFC 2616 HTTP协议语法的定义。
RFC 2396 URL语法的定义。
RFC 2109 Cookie是怎样工作的。
RFC 1867 HTTP如何POST,以及POST的格式。
文字
curl是免费软件,IBM公司对curl不提供技术支持。
curl官方网站:
二、curl 命令行下载工具使用方法小结
获取curl
curl命令行下载工具
curl的官方网站为:
官方下载页面为:
你可能并不清楚你需要下载哪个版本,没关系,官方提供了下载向导:
你可以根据自己的情况一步步选择后下载。我使用的版本
我的最终选择页面为:
下载的版本是:curl version: 7.19.5(SSL disabled)即上述页面第二个:
因为第一个不能下载,403error,第三个使用中存在缺失dll文件等问题
如何使用curl
curl并不是双击即可运行,你需要在命令提示符下使用它
如何进入命令提示符
点击“开始”——“运行”——输入CMD
或,WIN+R,输入CMD
下载我下载版本的CURL后,解压后文件夹放在如:D:/curl的文件夹里(curl路径)
命令提示符窗口中输入"d:"回车,然后输入“cd curl”即可跳转到curl文件夹,
至此可以输入curl命令了(根据你的curl类推)或你也可以将curl加入到系统环境变量如何将curl所在文件夹加入系统变量
右键单击“我的电脑”——“属性”——“高级”——“环境变量”——
“系统变量”——“Path”——“编辑”——加入“;D:/curl”(注意分号,
D:/curl换成你的curl路径)——“确定”加入到系统环境变量后可在命令提示符内直接运行如
“curl-O ”
这样的命令,无需进入curl所在文件夹curl命令用法
一个不错的Curl教程
1)
二话不说,先从这里开始吧!
curl
回车之后,www.yahoo.com的html就稀里哗啦地显示在屏幕上了~~~~~
2)
嗯,要想把读过来页面存下来,是不是要这样呢?
curl page.html
当然可以,但不用这么麻烦的!
用curl的内置option就好,存下http的结果,用这个option:-o
curl-o page.html
这样,你就可以看到屏幕上出现一个下载页面进度指示。等进展到100%,自然就OK咯
3)
什么什么?!访问不到?肯定是你的proxy没有设定了。
使用curl的时候,用这个option可以指定http访问所使用的proxy服务器及其端口:-x
curl-x 123.45.67.89:1080-o page.html
4)
访问有些网站的时候比较讨厌,他使用cookie来记录session信息。
像IE/NN这样的浏览器,当然可以轻易处理cookie信息,但我们的curl呢?.....
我们来学习这个option:-D--这个是把http的response里面的cookie信息存到一个特别的文件中去
curl-x 123.45.67.89:1080-o page.html-D cookie0001.txt
这样,当页面被存到page.html的同时,cookie信息也被存到了cookie0001.txt里面了
5)
那么,下一次访问的时候,如何继续使用上次留下的cookie信息呢?要知道,很多网站都是靠监视你的cookie信息,
来判断你是不是不按规矩访问他们的网站的。
这次我们使用这个option来把上次的cookie信息追加到http request里面去:-b
curl-x 123.45.67.89:1080-o page1.html-D cookie0002.txt-b cookie0001.txt
这样,我们就可以几乎模拟所有的IE操作,去访问网页了!
6)
稍微等等~~~~~我好像忘记什么了~~~~~
对了!是浏览器信息~~~~
有些讨厌的网站总要我们使用某些特定的浏览器去访问他们,有时候更过分的是,还要使用某些特定的版本~~~~
NND,哪里有时间为了它去找这些怪异的浏览器呢!?
好在curl给我们提供了一个有用的option,可以让我们随意指定自己这次访问所宣称的自己的浏览器信息:-A
curl-A"Mozilla/4.0(compatible; MSIE 6.0; Windows NT 5.0)"-x 123.45.67.89:1080-o page.html-D cookie0001.txt
这样,服务器端接到访问的要求,会认为你是一个运行在Windows 2000上的IE6.0,嘿嘿嘿,其实也许你用的是苹果机呢!
而"Mozilla/4.73 [en](X11; U; Linux 2.2; 15 i686"则可以告诉对方你是一台PC上跑着的Linux,用的是Netscape 4.73,呵呵呵
7)
另外一个服务器端常用的限制方法,就是检查http访问的referer。比如你先访问首页,再访问里面所指定的下载页,这第二次访问的 referer地址就是第一次访问成功后的页面地址。这样,服务器端只要发现对下载页面某次访问的referer地址不是首页的地址,就可以断定那是个盗连了~~~~~
讨厌讨厌~~~我就是要盗连~~~~~!!
幸好curl给我们提供了设定referer的option:-e
curl-A"Mozilla/4.0(compatible; MSIE 6.0; Windows NT 5.0)"-x 123.45.67.89:1080-e"mail.yahoo.com"-o page.html-D cookie0001.txt
这样,就可以骗对方的服务器,你是从mail.yahoo.com点击某个链接过来的了,呵呵呵
8)
写着写着发现漏掉什么重要的东西了!-----利用curl下载文件
刚才讲过了,下载页面到一个文件里,可以使用-o,下载文件也是一样。
比如, curl-o 1.jpg
这里教大家一个新的option:-O
大写的O,这么用: curl-O
这样,就可以按照服务器上的文件名,自动存在本地了!
再来一个更好用的。
如果screen1.JPG以外还有screen2.JPG、screen3.JPG、....、screen10.JPG需要下载,难不成还要让我们写一个script来完成这些操作?
不干!
在curl里面,这么写就可以了:
curl-O [1-10].JPG
呵呵呵,厉害吧?!~~~
9)
再来,我们继续讲解下载!
curl-O [001-201].JPG
这样产生的下载,就是
~zzh/001.JPG
~zzh/002.JPG
...
~zzh/201.JPG
~nick/001.JPG
~nick/002.JPG
...
~nick/201.JPG
够方便的了吧?哈哈哈
咦?高兴得太早了。
由于zzh/nick下的文件名都是001,002...,201,下载下来的文件重名,后面的把前面的文件都给覆盖掉了~~~
没关系,我们还有更狠的!
curl-o#2_#1.jpg [001-201].JPG
--这是.....自定义文件名的下载?
--对头,呵呵!
#1是变量,指的是这部分,第一次取值zzh,第二次取值nick
#2代表的变量,则是第二段可变部分---[001-201],取值从001逐一加到201
这样,自定义出来下载下来的文件名,就变成了这样:
原来:~zzh/001.JPG---下载后: 001-zzh.JPG
原来:~nick/001.JPG---下载后: 001-nick.JPG
这样一来,就不怕文件重名啦,呵呵
9)
继续讲下载
我们平时在windows平台上,flashget这样的工具可以帮我们分块并行下载,还可以断线续传。
curl在这些方面也不输给谁,嘿嘿
比如我们下载screen1.JPG中,突然掉线了,我们就可以这样开始续传
curl-c-O
当然,你不要拿个flashget下载了一半的文件来糊弄我~~~~别的下载软件的半截文件可不一定能用哦~~~
分块下载,我们使用这个option就可以了:-r
举例说明
比如我们有一个要下载(赵老师的电话朗诵:D)
我们就可以用这样的命令:
curl-r 0-10240-o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3/
curl-r 10241-20480-o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3/
curl-r 20481-40960-o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3/
curl-r 40961--o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3
这样就可以分块下载啦。
不过你需要自己把这些破碎的文件合并起来
如果你用UNIX或苹果,用 cat zhao.part* zhao.mp3就可以
如果用的是Windows,用copy/b来解决吧,呵呵
上面讲的都是http协议的下载,其实ftp也一样可以用。
用法嘛,
curl-u name:passwd
或者大家熟悉的
curl
10)
说完了下载,接下来自然该讲上传咯
上传的option是-T
比如我们向ftp传一个文件: curl-T localfile-u name:passwd
当然,向http服务器上传文件也可以
比如 curl-T localfile
注意,这时候,使用的协议是HTTP的PUT method
刚才说到PUT,嘿嘿,自然让老服想起来了其他几种methos还没讲呢!
GET和POST都不能忘哦。
http提交一个表单,比较常用的是POST模式和GET模式
GET模式什么option都不用,只需要把变量写在url里面就可以了
比如:
curl
而POST模式的option则是-d
比如,curl-d"user=nickwolfepassword=12345"
就相当于向这个站点发出一次登陆申请~~~~~
到底该用GET模式还是POST模式,要看对面服务器的程序设定。
一点需要注意的是,POST模式下的文件上的文件上传,比如
form method="POST" enctype="multipar/form-data" action=""
input type=file name=upload
input type=submit name=nick value="go"
/form
这样一个HTTP表单,我们要用curl进行模拟,就该是这样的语法:
curl-F upload=@localfile-F nick=go
罗罗嗦嗦讲了这么多,其实curl还有很多很多技巧和用法
比如 https的时候使用本地证书,就可以这样
curl-E localcert.pem
再比如,你还可以用curl通过dict协议去查字典~~~~~
curl dict://dict.org/d:computer
三、Linux必备下载命令之curl详解
curl简介
curl是一个非常实用的工具,用于与服务器之间进行数据传输,支持的协议众多,包括DICT, FILE, FTP, FTPS, GOPHER, HTTP, HTTPS, IMAP, IMAPS, LDAP, LDAPS, POP3, POP3S, RTMP, RTSP, SCP, SFTP, SMTP, SMTPS, TELNET and TFTP等。curl被设计为无需用户交互即可完成工作,它提供了一系列非常有用的功能,如代理访问、用户认证、ftp上传下载、HTTP POST、SSL连接、cookie支持、断点续传等。
curl用法
curl命令语法和参数详解。由于curl功能强大,所以命令参数繁多。下表只列出部分参数,更多参数请运行“man curl”命令查看。
curl参数选项
常用选项分类。以下是一些常用的curl实例:
抓取页面内容到一个文件中,使用-O选项,确保url后面跟具体文件名,否则无法抓取。可以使用正则表达式来抓取所需内容。
模拟用户登录,模拟表单信息,模拟登录并保存cookie信息。使用-c选项保存cookie,而-D选项中的cookie则不同。
使用cookie文件进行断点续传,使用-C选项传送数据。最好在登录页面测试,因为你可以看到传值是否成功。
显示抓取错误,使用-f选项伪造来源地址,避免网站屏蔽。使用-e选项设置代理。分段下载,将文件片段cat合并。
不显示下载进度信息,使用-s选项显示下载进度条。通过ftp下载文件或上传文件,使用ftp命令。
收集快速用法,配合sed/awk/grep进行下载保存,GET和POST文件,通过代理保存cookie,使用cookie模仿浏览器伪造referer。高级下载功能包括循环下载、匹配下载、引用下载、断点续传和分块下载。
curl语法及选项整理
curl(7.29.0)所支持的选项参数如下: