curl下载 Linux必备下载命令之curl详解

更新时间:2025-03-26  版本:v0326

一、curl的用法

curl是一个利用URL语法在命令行方式下工作的文件传输工具。本文介绍了它的简单用法。

*******************************************************************************************************************************************************

curl下载 Linux必备下载命令之curl详解

curl是一个利用URL语法在命令行方式下工作的文件传输工具。

它支持很多协议:FTP, FTPS, HTTP, HTTPS, GOPHER, TELNET, DICT, FILE以及 LDAP。

curl同样支持HTTPS认证,HTTP POST方法, HTTP PUT方法, FTP上传, kerberos认证, HTTP上传,代理服务器, cookies,用户名/密码认证,下载文件断点续传,上载文件断点续传, http代理服务器管道( proxy tunneling),甚至它还支持IPv6, socks5代理服务器,通过http代理服务器上传文件到FTP服务器等等,功能十分强大。

Windows操作系统下的网络蚂蚁,网际快车(FlashGet)的功能它都可以做到。准确的说,curl支持文件的上传和下载,所以是一个综合传输工具,但是按照传统,用户习惯称curl为下载工具。

curl是瑞典curl组织开发的,您可以访问:

curl下载 Linux必备下载命令之curl详解

获取它的源代码和相关说明。

鉴于curl在Linux上的广泛使用,IBM在AIX Linux Toolbox的光盘中包含了这个软件,并且您可以访问IBM网站:

1.ibm.com/servers/aix/products/aixos/linux/altlic.html下载它。

curl的最新版本是 7.10.8,IBM网站上提供的版本为7.9.3。

在AIX下的安装很简单,IBM网站上下载的rpm格式的包。

在 ,您可以下载到UNIX格式的man帮助,里面有详细的curl工具的使用说明。

curl的用法为:curl [options] [URL...]

其中options是下载需要的参数,大约有80多个,curl的各个功能完全是依靠这些参数完成的。

具体参数的使用,用户可以参考curl的man帮助。

下面,本文就将结合具体的例子来说明怎样利用curl进行下载。

1、获得一张页面

使用命令:curl

这是最简单的使用方法。用这个命令获得了指向的页面,同样,如果这里的URL指向的是一个文件或者一幅图都可以直接下载到本地。如果下载的是HTML文档,那么缺省的将不显示文件头部,即HTML文档的header。要全部显示,请加参数-i,要只显示头部,用参数-I。任何时候,可以使用-v命令看curl是怎样工作的,它向服务器发送的所有命令都会显示出来。为了断点续传,可以使用-r参数来指定传输范围。

2、表单(Form)的获取

在WEB页面设计中,form是很重要的元素。Form通常用来收集并向网站提交信息。提交信息的方法有两种,GET方法和POST方法。先讨论GET方法,例如在页面中有这样一段:

<form method="GET" action="junk.cgi">

<input type=text name="birthyear">

<input type=submit name=press value="OK">

</form>

那么浏览器上会出现一个文本框和一个标为“OK”的按钮。按下这个按钮,表单就用GET方法向服务器提交文本框的数据。

例如原始页面是在 www.hotmail.com/when/birth.html看到的,然后您在文本框中输入1905,然后按OK按钮,那么浏览器的URL现在应该是:“www.hotmail.com/when/junk.cgi?birthyear=1905&;press=OK”

对于这种网页,curl可以直接处理,例如想获取上面的网页,只要输入:

curl"www.hotmail.com/when/junk.cgi?birthyear=1905&;press=OK"

就可以了。

表单用来提交信息的第二种方法叫做POST方法,POST方法和GET方法的区别在于GET方法使用的时候,浏览器中会产生目标URL,而POST不会。类似GET,这里有一个网页:

<form method="POST" action="junk.cgi">

<input type=text name="birthyear">

<input type=submit name=press value="OK">

</form>

浏览器上也会出现一个文本框和一个标为“OK”的按钮。按下这个按钮,表单用POST方法向服务器提交数据。

这时的URL是看不到的,因此需要使用特殊的方法来抓取这个页面:

curl-d"birthyear=1905&press=OK" www.hotmail.com/when/junk.cgi

这个命令就可以做到。

1995年年末,RFC 1867定义了一种新的POST方法,用来上传文件。主要用于把本地文件上传到服务器。此时页面是这样写的:

<form method="POST" enctype='multipart/form-data' action="upload.cgi">

<input type=file name=upload>

<input type=submit name=press value="OK">

</form>

对于这种页面,curl的用法不同:

curl-F upload=@localfilename-F press=OK URL

这个命令的实质是将本地的文件用POST上传到服务器。

有关POST还有不少用法,用户可以自己摸索。

3、使用PUT方法。

HTTP协议文件上传的标准方法是使用PUT,此时curl命令使用-T参数:

curl-T uploadfile www.uploadhttp.com/receive.cgi

4、有关认证。

curl可以处理各种情况的认证页面,例如下载用户名/密码认证方式的页面(在IE中通常是出现一个输入用户名和密码的输入框):

curl-u name:password www.secrets.com

如果网络是通过http代理服务器出去的,而代理服务器需要用户名和密码,那么输入:

curl-U proxyuser:proxypassword

任何需要输入用户名和密码的时候,只在参数中指定用户名而空着密码,curl可以交互式的让用户输入密码。

5、引用。

有些网络资源访问的时候必须经过另外一个网络地址跳转过去,这用术语来说是:referer,引用。

对于这种地址的资源,curl也可以下载:

curl-e daniel.haxx.se

6、指定用户客户端。

有些网络资源首先需要判断用户使用的是什么浏览器,符合标准了才能够下载或者浏览。

此时curl可以把自己“伪装”成任何其他浏览器:

curl-A"Mozilla/4.0(compatible; MSIE 5.01; Windows NT 5.0)" URL

这个指令表示curl伪装成了IE5.0,用户平台是Windows 2000。(对方服务器是根据这个字串来判断客户端的类型的,所以即使使用AIX也无所谓)。

使用:

curl-A"Mozilla/4.73 [en](X11; U; Linux 2.2.15 i686)" URL

此时curl变成了Netscape,运行在PIII平台的Linux上了。

7、COOKIES

Cookie是服务器经常使用的一种记忆客户信息的方法。如果cookie被记录在了文件中,那么使用命令:

curl-b stored_cookies_in_file www.cookiesite.com

curl可以根据旧的cookie写出新cookie并发送到网站:

curl-b cookies.txt-c newcookies.txt www.cookiesite.com

8、加密的HTTP——HTTPS。

如果是通过OpenSSL加密的https协议传输的网页,curl可以直接访问:

curl

9、http认证。

如果是采用证书认证的http地址,证书在本地,那么curl这样使用:

curl-E mycert.pem

参考读物和注意事项:

curl非常博大,用户要想使用好这个工具,除了详细学习参数之外,还需要深刻理解http的各种协议与URL的各个语法。

这里推荐几个读物:

RFC 2616 HTTP协议语法的定义。

RFC 2396 URL语法的定义。

RFC 2109 Cookie是怎样工作的。

RFC 1867 HTTP如何POST,以及POST的格式。

文字

curl是免费软件,IBM公司对curl不提供技术支持。

curl官方网站:

二、curl 命令行下载工具使用方法小结

获取curl

curl命令行下载工具

curl的官方网站为:

官方下载页面为:

你可能并不清楚你需要下载哪个版本,没关系,官方提供了下载向导:

你可以根据自己的情况一步步选择后下载。我使用的版本

我的最终选择页面为:

下载的版本是:curl version: 7.19.5(SSL disabled)即上述页面第二个:

因为第一个不能下载,403error,第三个使用中存在缺失dll文件等问题

如何使用curl

curl并不是双击即可运行,你需要在命令提示符下使用它

如何进入命令提示符

点击“开始”——“运行”——输入CMD

或,WIN+R,输入CMD

下载我下载版本的CURL后,解压后文件夹放在如:D:/curl的文件夹里(curl路径)

命令提示符窗口中输入"d:"回车,然后输入“cd curl”即可跳转到curl文件夹,

至此可以输入curl命令了(根据你的curl类推)或你也可以将curl加入到系统环境变量如何将curl所在文件夹加入系统变量

右键单击“我的电脑”——“属性”——“高级”——“环境变量”——

“系统变量”——“Path”——“编辑”——加入“;D:/curl”(注意分号,

D:/curl换成你的curl路径)——“确定”加入到系统环境变量后可在命令提示符内直接运行如

“curl-O ”

这样的命令,无需进入curl所在文件夹curl命令用法

一个不错的Curl教程

1)

二话不说,先从这里开始吧!

curl

回车之后,www.yahoo.com的html就稀里哗啦地显示在屏幕上了~~~~~

2)

嗯,要想把读过来页面存下来,是不是要这样呢?

curl page.html

当然可以,但不用这么麻烦的!

用curl的内置option就好,存下http的结果,用这个option:-o

curl-o page.html

这样,你就可以看到屏幕上出现一个下载页面进度指示。等进展到100%,自然就OK咯

3)

什么什么?!访问不到?肯定是你的proxy没有设定了。

使用curl的时候,用这个option可以指定http访问所使用的proxy服务器及其端口:-x

curl-x 123.45.67.89:1080-o page.html

4)

访问有些网站的时候比较讨厌,他使用cookie来记录session信息。

像IE/NN这样的浏览器,当然可以轻易处理cookie信息,但我们的curl呢?.....

我们来学习这个option:-D--这个是把http的response里面的cookie信息存到一个特别的文件中去

curl-x 123.45.67.89:1080-o page.html-D cookie0001.txt

这样,当页面被存到page.html的同时,cookie信息也被存到了cookie0001.txt里面了

5)

那么,下一次访问的时候,如何继续使用上次留下的cookie信息呢?要知道,很多网站都是靠监视你的cookie信息,

来判断你是不是不按规矩访问他们的网站的。

这次我们使用这个option来把上次的cookie信息追加到http request里面去:-b

curl-x 123.45.67.89:1080-o page1.html-D cookie0002.txt-b cookie0001.txt

这样,我们就可以几乎模拟所有的IE操作,去访问网页了!

6)

稍微等等~~~~~我好像忘记什么了~~~~~

对了!是浏览器信息~~~~

有些讨厌的网站总要我们使用某些特定的浏览器去访问他们,有时候更过分的是,还要使用某些特定的版本~~~~

NND,哪里有时间为了它去找这些怪异的浏览器呢!?

好在curl给我们提供了一个有用的option,可以让我们随意指定自己这次访问所宣称的自己的浏览器信息:-A

curl-A"Mozilla/4.0(compatible; MSIE 6.0; Windows NT 5.0)"-x 123.45.67.89:1080-o page.html-D cookie0001.txt

这样,服务器端接到访问的要求,会认为你是一个运行在Windows 2000上的IE6.0,嘿嘿嘿,其实也许你用的是苹果机呢!

而"Mozilla/4.73 [en](X11; U; Linux 2.2; 15 i686"则可以告诉对方你是一台PC上跑着的Linux,用的是Netscape 4.73,呵呵呵

7)

另外一个服务器端常用的限制方法,就是检查http访问的referer。比如你先访问首页,再访问里面所指定的下载页,这第二次访问的 referer地址就是第一次访问成功后的页面地址。这样,服务器端只要发现对下载页面某次访问的referer地址不是首页的地址,就可以断定那是个盗连了~~~~~

讨厌讨厌~~~我就是要盗连~~~~~!!

幸好curl给我们提供了设定referer的option:-e

curl-A"Mozilla/4.0(compatible; MSIE 6.0; Windows NT 5.0)"-x 123.45.67.89:1080-e"mail.yahoo.com"-o page.html-D cookie0001.txt

这样,就可以骗对方的服务器,你是从mail.yahoo.com点击某个链接过来的了,呵呵呵

8)

写着写着发现漏掉什么重要的东西了!-----利用curl下载文件

刚才讲过了,下载页面到一个文件里,可以使用-o,下载文件也是一样。

比如, curl-o 1.jpg

这里教大家一个新的option:-O

大写的O,这么用: curl-O

这样,就可以按照服务器上的文件名,自动存在本地了!

再来一个更好用的。

如果screen1.JPG以外还有screen2.JPG、screen3.JPG、....、screen10.JPG需要下载,难不成还要让我们写一个script来完成这些操作?

不干!

在curl里面,这么写就可以了:

curl-O [1-10].JPG

呵呵呵,厉害吧?!~~~

9)

再来,我们继续讲解下载!

curl-O [001-201].JPG

这样产生的下载,就是

~zzh/001.JPG

~zzh/002.JPG

...

~zzh/201.JPG

~nick/001.JPG

~nick/002.JPG

...

~nick/201.JPG

够方便的了吧?哈哈哈

咦?高兴得太早了。

由于zzh/nick下的文件名都是001,002...,201,下载下来的文件重名,后面的把前面的文件都给覆盖掉了~~~

没关系,我们还有更狠的!

curl-o#2_#1.jpg [001-201].JPG

--这是.....自定义文件名的下载?

--对头,呵呵!

#1是变量,指的是这部分,第一次取值zzh,第二次取值nick

#2代表的变量,则是第二段可变部分---[001-201],取值从001逐一加到201

这样,自定义出来下载下来的文件名,就变成了这样:

原来:~zzh/001.JPG---下载后: 001-zzh.JPG

原来:~nick/001.JPG---下载后: 001-nick.JPG

这样一来,就不怕文件重名啦,呵呵

9)

继续讲下载

我们平时在windows平台上,flashget这样的工具可以帮我们分块并行下载,还可以断线续传。

curl在这些方面也不输给谁,嘿嘿

比如我们下载screen1.JPG中,突然掉线了,我们就可以这样开始续传

curl-c-O

当然,你不要拿个flashget下载了一半的文件来糊弄我~~~~别的下载软件的半截文件可不一定能用哦~~~

分块下载,我们使用这个option就可以了:-r

举例说明

比如我们有一个要下载(赵老师的电话朗诵:D)

我们就可以用这样的命令:

curl-r 0-10240-o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3/

curl-r 10241-20480-o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3/

curl-r 20481-40960-o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3/

curl-r 40961--o"zhao.part1" http:/cgi2.tky.3web.ne.jp/~zzh/zhao1.mp3

这样就可以分块下载啦。

不过你需要自己把这些破碎的文件合并起来

如果你用UNIX或苹果,用 cat zhao.part* zhao.mp3就可以

如果用的是Windows,用copy/b来解决吧,呵呵

上面讲的都是http协议的下载,其实ftp也一样可以用。

用法嘛,

curl-u name:passwd

或者大家熟悉的

curl

10)

说完了下载,接下来自然该讲上传咯

上传的option是-T

比如我们向ftp传一个文件: curl-T localfile-u name:passwd

当然,向http服务器上传文件也可以

比如 curl-T localfile

注意,这时候,使用的协议是HTTP的PUT method

刚才说到PUT,嘿嘿,自然让老服想起来了其他几种methos还没讲呢!

GET和POST都不能忘哦。

http提交一个表单,比较常用的是POST模式和GET模式

GET模式什么option都不用,只需要把变量写在url里面就可以了

比如:

curl

而POST模式的option则是-d

比如,curl-d"user=nickwolfepassword=12345"

就相当于向这个站点发出一次登陆申请~~~~~

到底该用GET模式还是POST模式,要看对面服务器的程序设定。

一点需要注意的是,POST模式下的文件上的文件上传,比如

form method="POST" enctype="multipar/form-data" action=""

input type=file name=upload

input type=submit name=nick value="go"

/form

这样一个HTTP表单,我们要用curl进行模拟,就该是这样的语法:

curl-F upload=@localfile-F nick=go

罗罗嗦嗦讲了这么多,其实curl还有很多很多技巧和用法

比如 https的时候使用本地证书,就可以这样

curl-E localcert.pem

再比如,你还可以用curl通过dict协议去查字典~~~~~

curl dict://dict.org/d:computer

三、Linux必备下载命令之curl详解

curl简介

curl是一个非常实用的工具,用于与服务器之间进行数据传输,支持的协议众多,包括DICT, FILE, FTP, FTPS, GOPHER, HTTP, HTTPS, IMAP, IMAPS, LDAP, LDAPS, POP3, POP3S, RTMP, RTSP, SCP, SFTP, SMTP, SMTPS, TELNET and TFTP等。curl被设计为无需用户交互即可完成工作,它提供了一系列非常有用的功能,如代理访问、用户认证、ftp上传下载、HTTP POST、SSL连接、cookie支持、断点续传等。

curl用法

curl命令语法和参数详解。由于curl功能强大,所以命令参数繁多。下表只列出部分参数,更多参数请运行“man curl”命令查看。

curl参数选项

常用选项分类。以下是一些常用的curl实例:

抓取页面内容到一个文件中,使用-O选项,确保url后面跟具体文件名,否则无法抓取。可以使用正则表达式来抓取所需内容。

模拟用户登录,模拟表单信息,模拟登录并保存cookie信息。使用-c选项保存cookie,而-D选项中的cookie则不同。

使用cookie文件进行断点续传,使用-C选项传送数据。最好在登录页面测试,因为你可以看到传值是否成功。

显示抓取错误,使用-f选项伪造来源地址,避免网站屏蔽。使用-e选项设置代理。分段下载,将文件片段cat合并。

不显示下载进度信息,使用-s选项显示下载进度条。通过ftp下载文件或上传文件,使用ftp命令。

收集快速用法,配合sed/awk/grep进行下载保存,GET和POST文件,通过代理保存cookie,使用cookie模仿浏览器伪造referer。高级下载功能包括循环下载、匹配下载、引用下载、断点续传和分块下载。

curl语法及选项整理

curl(7.29.0)所支持的选项参数如下: