目录
一、如何安装Curl.exe?
1.下载安装包
2.安装
二、curl命令语法与curl命令参数详解
1、curl命令语法
2、curl命令参数详解
四、curl使用的常用命令
1、下载(option:-o或者option:-O)
2、上传文件(option:-T)
3、伪造来源页面|伪造referer|盗链 (option:-e)
4、伪造代理设备(模仿浏览器)
5、设置http请求
6、http响应头
7、发送表单数据
8、cookie
9、测试一个网址
10、保存访问的网页(>>)
11、请求方式
12、调试
13、显示抓取错误
四、总结
Curl是一个功能强大的命令行工具,可以看做是命令行浏览器。用于与服务器进行数据交互,支持多种数据传输协议,如HTTP、HTTPS、FTP等。它支持文件的上传和下载,所以是综合传输工具,但习惯称curl为下载工具。它是一款开源软件,在多个操作系统上均可运行,包括Windows、Linux、macOS等。Linux系统自带curl,Windows下需要自行安装才能使用。
一、如何安装Curl.exe?
一般来说,Linux系统自带curl,Windows下需要自行安装才能使用。如果没有,我们需要首先安装 curl 。
1.下载安装包
下载直通车:
https://curl.se/windows
curl官网下载地址:
https://curl.se/download.html
2.安装
mac:可通过命令直接安装 brew install curl。
windows:通过上面的资源下载地址,找到windows版本下载解压得到.exe文件,全局使用需配置环境变量。
linux具体版本快捷安装方式:centos: yum -y install curl ubuntu: sudo apt-get install curl其他发行版,建议通过上面的资源下载地址,下载Linux版本解压tar -xzvf xxx.tar.gz,然后安装。
二、curl命令语法与curl命令参数详解
1、curl命令语法
curl [options] [URL...]
2、curl命令参数详解
由于linux curl功能十分强大,所以命令参数十分多,下表只是帅选出来的部分参数,更多参数请运行“man curl”命令查看。
参数组参数描述url url需要抓取的一到多个URLs;
多个下面通配符的方式:
1、http://{www,ftp,mail}.aiezu.com;
2、http://aiezu.com/images/[001-999].jpg;
3、http://aiezu.com/images/[1-999].html;
4、ftp://aiezu.com/file[a-z].txt
请
求
头-H "name: value"
--header "name: value"(HTTP)添加一个http header(http请求头);
-H "name:"
--header "name:"(HTTP)移除一个http header(http请求头);
-A "string"
--user-agent "string"(HTTP)设置Http请求头“User-Agent”,服务器通过“User-Agent”可以判断客户端使用的浏览器名称和操作系统类型,伪造此参数能导致服务器做出错误判断。
也可以使用“-H”, “--header option”设置此选项;
-e
--referer
-e "aiezu.com"相当于“-H "Referer: www.qq.com"”;
响
应
头-I
--head (HTTP)只输出HTTP-header,不获取内容(HTTP/FTP/FILE)。
用于HTTP服务时,获取页面的http头;
(如:curl -I http://aiezu.com)
用于FTP/FILE时,将会获取文件大小、最后修改时间;
(如:curl -I file://test.txt)
-i
--include (HTTP)输出HTTP头和返回内容;
-D
--dump-header
cookie-b name=data
--cookie name=data (HTTP)发送cookie数据到HTTP服务器,数据格式为:"NAME1=VALUE1; NAME2=VALUE2";
如果行中没有“=”,将把参数值当作cookie文件名;
这个cookie数据可以是由服务器的http响应头“Set-Cookie:”行发送过来的;
-c filename
--cookie-jar file name (HTTP)完成操作后将服务器返回的cookies保存到指定的文件;
指定参数值为“-”将定向到标准输出“如控制台”;
-j
--junk-session-cookies (HTTP)告诉curl放弃所有的"session cookies";
相当于重启浏览器;
代理-x host:port
-x [protocol://[user:pwd@]host[:port]
--proxy [protocol://[user:pwd@]host[:port]使用HTTP代理访问;如果未指定端口,默认使用8080端口;
protocol默认为http_proxy,其他可能的值包括:
http_proxy、HTTPS_PROXY、socks4、socks4a、socks5;
如:
--proxy 8.8.8.8:8080;
-x "http_proxy://aiezu:123@aiezu.com:80"-p
--proxytunnel将“-x”参数的代理,作为通道的方式去代理非HTTP协议,如ftp;
--socks4
--socks4a
--socks5
使用SOCKS4A代理;
使用SOCKS5代理;
此参数会覆盖“-x”参数;
--proxy-anyauth
--proxy-basic
--proxy-diges
--proxy-negotiate
--proxy-ntlm http代理认证方式,参考:
--anyauth
--basic
--diges
--negotiate
--ntlm-U
--proxy-user
数据
传输-G
--get如果使用了此参数,“-d/”、“--data”、“--data-binary”参数设置的数据,讲附加在url上,以GET的方式请求;
-d @file
-d "string"
--data "string"
--data-ascii "string"
--data-binary "string"
--data-urlencode "string"(HTTP)使用HTTP POST方式发送“key/value对”数据,相当于浏览器表单属性(method="POST",enctype="application/x-www-form-urlencoded")
-d,--data:HTTP方式POST数据;
--data-ascii:HTTP方式POST ascii数据;
--data-binary:HTTP方式POST二进制数据;
--data-urlencode:HTTP方式POST数据(进行urlencode);
如果数据以“@”开头,后紧跟一个文件,将post文件内的内容;
-F name=@file
-F name= -F name=content --form name=content (HTTP)使用HTTP POST方式发送类似“表单字段”的多类型数据,相当于同时设置浏览器表单属性(method="POST",enctype="multipart/form-data"),可以使用此参数上传二进制文件。 如果字段内容以“@”开头,剩下的部分应该是文件名,curl将会上传此文件,如: curl -F "pic=@pic.jpg" http://aiezu.com; curl -F "page=@a.html;type=text/html" http://aiezu.com curl -F "page=@/tmp/a;filename=a.txt" http://aiezu.com 如果字段内容以“<”开头,剩下的部分应该是文件名,curl将从文件中获取作为此字段的值,如:curl -F "text= --form-string -T file --upload-file file通过“put”的方式将文件传输到远程网址; 选项参数只使用字符"-",将通过stdin读入文件内容; cat test.txt|curl "http://aiezu.com/a.php" -T - curl "http://aiezu.com/a.php" -T - curl -T "{file1,file2}" http://aiezu.com curl -T "img[1-1000].png" http://aiezu.com断点 续传-C --continue-at offset续传开始的位置,如果offset值为“-”,curl会自动从文件中识别起始位置开始传输; -r --range 0-499:最前面500字节; -500:最后面500字节; 9500-:最前面9500字节; 0-0,-1:最前面和最后面的1字节; 100-199,500-599:两个100字节; 认证--basic (HTTP)告诉curl使用HTTP Basic authentication(HTTP协议时),这是默认认证方式; --ntlm (HTTP)使用NTLM身份验证方式,用于HTTP协议; 一般用于IIS使用NTLM的网站; --digest (HTTP)使用HTTP Digest authentication加密,用于HTTP协议; 配合“-u/--user”选项,防止密码使用明文方式发送; --negotiate (HTTP)使用GSS-Negotiate authentication方式,用于HTTP协议; 它主要目的是为它的主要目的是为kerberos5认证提供支持支持; --anyauth (HTTP)告诉curl自动选择合适的身份认证方法,并选用最安全的方式; -u user:password --user user:password使用用户名、密码认证,此参数会覆盖“-n”、“--netrc”和“--netrc-optional”选项; 如果你只提供用户名,curl将要求你输入密码; 如果你使用“SSPI”开启的curl库做“NTLM”认证,可以使用不含用户名密码的“-u:”选项,强制curl使用当前登录的用户名密码进行认证; 此参数相当于设置http头“Authorization:”; 证书-E <证书[:密码]> --cert <证书[:密码]>(SSL)指定“PEM”格式的证书文件和证书密码; --cert-type 默认为“PEM”; --cacert --capath 这些证书必须是“PEM”格式; --crlfile -k --insecure (SSL)设置此选项将允许使用无证书的不安全SSL进行连接和传输。 SSL 其他--ciphers --engine 使用“curl --engine list”查看支持的加密引擎列表; --random-file (SSL)指定包含随机数据的文件路径名;数据是用来为SSL连接产生随机种子为; --egd-file -1/--tlsv1 --tlsv1.0 --tlsv1.1 --tlsv1.2 -2/--sslv2 -3/--sslv3 (SSL)使用TLS版本2与远程服务器通讯; (SSL)使用TLS 1.0版本与远程服务器通讯; (SSL)使用TLS 1.1版本与远程服务器通讯; (SSL)使用TLS 1.2版本与远程服务器通讯; (SSL)使用SSL版本2与远程服务器通讯; (SSL)使用SSL版本3与远程服务器通讯; 私钥 公钥--key --key-type --pass --pubkey FTP-P --ftp-port <接口>(FTP)FTP主动模式时,设置一个地址等待服务器的连接,如: 网卡:eth1 IP:8.8.8.8 主机名:aiezu.com 可以加端口号:eth1:20000-21000;--crlf (FTP)上传时将换行符(LF)转换为回车换行(CRLF); --ftp-account [data](FTP)ftp帐号信息; --ftp-method [method](FTP)可选值:multicwd/nocwd/singlecwd; --ftp-pasv (FTP)使用使用PASV(被动)/EPSV模式; --ftp-skip-pasv-ip (FTP)使用PASV的时,跳过指定IP; --ftp-create-dirs (FTP)上传时自动创建远程目录; -l --list-only (FTP)列出ftp文件列表; -B --use-ascii (FTP/LDAP)使用Ascii传输模式,用于FTP、LDAP;在ftp中相当与使用了“type=A;”模式。 --disable-epsv (FTP)告诉curl在PASV(被动模式)时不要使用EPSV; --disable-eprt (FTP)告诉curl在主动模式时禁用EPRT和LPRT; 限速--limit-rate -y --speed-time This option controls transfers and thus will not affect slow connects etc. If this is a concern for you, try the --connect-timeout option. -Y --speed-limit 其他 选项-0/--http1.0 (HTTP) 强制curl使用HTTP 1.0而不是使用默认的HTTP 1.1; --interface curl --interface eth0 http://aiezu.com curl --interface 10.0.0.101 http://aiezu.com-X --request --keepalive-time --no-buffer禁用对输出流缓冲; --buffer启用输出流缓冲; -L --location (HTTP/HTTPS)追随http响应头“Location:”定向到跳转后的页面; (在http响应码为3XX时使用,如301跳转、302跳转)--location-trusted (HTTP/HTTPS)同“--location”,但跳转后会发送跳转前的用户名和密码; --compressed (HTTP)请求对返回内容使用压缩算法进行压缩;curl支持对gzip压缩进行解压; --connect-timeout -m seconds --max-time seconds限制整个curl操作的最长时间,单位为秒; -s --silent安静模式。不要显示进度表或错误消息; -# --progress-bar显示进度条; 错误 选项-f --fail (HTTP)连接失败时(400以上错误)不返回默认错误页面,而是返回一个curl错误码“22”; --retry --retry-delay --retry-max-time 重试间隔时间; 最大重试时间; -S --show-error安静模式下显示错误信息; --stderr 输出-o file --output file将返回内容输出到文件。 如果是用过通配符获取多个url,可以使用“#”后跟“数字序号”,curl会自动将它替换对应的关键词,如: curl "http://aiezu.com/{a,b}.txt" -o "#1.txt"; 将保存为:“a.txt”,“b.txt”; curl "http://aiezu.com/{a,b}_[1-3].txt" -o "#1#2.txt"; 将保存为:a1.txt、a2.txt、a3.txt、b1.txt、b2.txt、b3.txt 如果要根据规则创建保存目录,参考:“--create-dirs” 指定“-”将定向到标准输出“如控制台”; -O --remote-name将返回内容输出到当前目录下,和url中文件名相同的文件中(不含目录); --create-dirs与“-o”参数配合使用,创建必要的本地目录层次结构-w --write-out format操作完成后在返回信息尾部追加指定的内容;要追加的内容可以是一个字符串“string”、从文件中获取“@filename”、从标准输入中获取“@-” 格式参数中可以用%{variable_name} 方式使用响应信息的相关变量,如:%{content_type}、%{http_code}、%{local_ip}...,更多变量参考“man curl”获取; 格式参数可以使用“\n”、“\r”、“\t”等转义字符; 调试--trace 使用“-”作为文件名将输出发送到标准输出。 --trace-ascii file转储所有传入和传出的数据到文件,包括描述信息,只转储ASCII部分,更容易阅读; 使用“-”作为文件名将输出发送到标准输出。 这个选项会覆盖之前使用的-v、 --verbose、 --trace-ascii选项; --trace-time转储文件中添加时间信息; -K --config --verbose显示更详细的信息,调试时使用; 帮助-M --manual显示完整的帮助手册; -h --help linux curl用法帮助; curl使用的常用命令 curl -o dodo1.jpg http:www.linux.com/dodo1.JPG #要注意-O这里后面的url要具体到某个文件,不然抓不下来 curl -O http://www.linux.com/dodo1.JPG 有时候下载图片可以能是前面的部分名称是一样的,就最后的尾椎名不一样。这样就会把dodo1,dodo2,dodo3,dodo4,dodo5全部保存下来 curl -O http://www.linux.com/dodo[1-5].JPG 在hello/dodo1.JPG的文件下载下来就会变成hello_dodo1.JPG,其他文件依此类推,从而有效的避免了文件被覆盖 curl -o #1_#2.JPG http://www.linux.com/{hello,bb}/dodo[1-5].JPG 由于下载的hello与bb中的文件名都是dodo1,dodo2,dodo3,dodo4,dodo5。因此第二次下载的会把第一次下载的覆盖,这样就需要对文件进行重命名。 curl -O http://www.linux.com/{hello,bb}/dodo[1-5].JPG curl -r 0-100 -o dodo1_part1.JPG http://www.linux.com/dodo1.JPG curl -r 100-200 -o dodo1_part2.JPG http://www.linux.com/dodo1.JPG curl -r 200- -o dodo1_part3.JPG http://www.linux.com/dodo1.JPG cat dodo1_part* > dodo1.JPG #这样就可以查看dodo1.JPG的内容了 curl可以通过ftp下载文件,curl提供两种从ftp中下载的语法 curl -O -u 用户名:密码 ftp://www.linux.com/dodo1.JPG curl -O ftp://用户名:密码@www.linux.com/dodo1.JPG 1.6、下载,显示进度条(option:-#)或不显示进度条(option:-s) curl -# -O http://www.linux.com/dodo1.JPG curl -s -O http://www.linux.com/dodo1.JPG 1.7、下载,断点续传(-C curl -# -o centos6.8.iso -C - http://mirrors.aliyun.com/centos/6.8/isos/x86_64/CentOS-6.8-x86_64-minimal.iso curl -C -O http://www.linux.com/dodo1.JPG curl -T dodo1.JPG -u 用户名:密码 ftp://www.linux.com/img/ 3、伪造来源页面|伪造referer|盗链 (option:-e)很多服务器会检查http访问的referer从而来控制访问。比如:你是先访问首页,然后再访问首页中的邮箱页面,这里访问邮箱的referer地址就是访问首页成功后的页面地址,如果服务器发现对邮箱页面访问的referer地址不是首页的地址,就断定那是个盗连了 #这样就会让服务器其以为你是从www.linux.com点击某个链接过来的 curl -e "www.linux.com" http://mail.linux.com #告诉访问网站,我是从百度来的 curl -e http://baidu.com http://linux.com 有些网站需要使用特定的浏览器去访问他们,有些还需要使用某些特定的版本。curl内置option:-A可以让我们指定浏览器去访问网站 curl -A "Mozilla/4.0 (compatible; MSIE 8.0; Windows NT 5.0)" http://www.linux.com #告诉爱E族,我是GOOGLE爬虫蜘蛛(其实我是curl命令) curl -A " Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" http://aiezu.com #告诉爱E族,我用的是微信内置浏览器 curl -A "Mozilla/5.0 AppleWebKit/600 Mobile MicroMessenger/6.0" http://aiezu.com 5.1、设置http请求头(或option:-H或option:--head) curl -H "Cache-Control:no-cache" http://aiezu.com #很多时候上网需要用到代理服务器(比如是使用代理服务器上网或者因为使用curl别人网站而被别人屏蔽IP地址的时候),幸运的是curl通过使用内置option:-x来支持设置代理 curl -x 192.168.100.100:1080 http://www.linux.com # 看看本站的http头是怎么样的 curl -I http://aiezu.com HTTP/1.1 200 OK Date: Fri, 25 Nov 2016 16:45:49 GMT Server: Apache Set-Cookie: rox__Session=abdrt8vesprhnpc3f63p1df7j4; path=/ Expires: Thu, 19 Nov 1981 08:52:00 GMT Cache-Control: no-store, no-cache, must-revalidate, post-check=0, pre-check=0 Pragma: no-cache Vary: Accept-Encoding Content-Type: text/html; charset=utf-8 6.2、保存http的response里面的header信息(option:-D) curl -D cookied.txt http://www.linux.com 执行后cookie信息就被存到了cookied.txt里面了 注意:-c(小写)产生的cookie和-D里面的cookie是不一样的。 curl -F "pic=@logo.png" -F "site=aiezu" http://aiezu.com/ #有些网站是使用cookie来记录session信息。对于chrome这样的浏览器,可以轻易处理cookie信息,但在curl中只要增加相关参数也是可以很容易的处理cookie curl -b "domain=aiezu.com" http://aiezu.com #很多网站都是通过监视你的cookie信息来判断你是否按规矩访问他们的网站的,因此我们需要使用保存的cookie信息。内置option: -b curl -b cookiec.txt http://www.linux.com 8.2、保存http的response里面的cookie信息(option:-c) 执行后http的response里面的cookie信息就被存到了cookiec.txt里面了 curl -c cookiec.txt http://www.linux.com curl -v http://www.linux.com 9.2、测试网页返回值(option:-w [format]) curl -o /dev/null -s -w %{http_code} www.linux.com 使用linux的重定向功能保存 curl http://www.linux.com >> linux.html curl -i -v -H '' -X POST -d '' http:www.test.com/a/b 其中,-X POST -d, -X GET -d, -X PUT -d 分别等价于-F, -G -d, -P 11.1、 -X POST -d (11.1.1)、POST application/x-www-form-urlencoded application/x-www-form-urlencoded是默认的 curl -X POST -d "param1=value1¶m2=value2" http://localhost:3000/data 等价于 curl -H "Content-Type:application/x-www-form-urlencoded" -X POST -d "param1=value1¶m2=value2" http://localhost:3000/data 使用数据文件 curl -X POST -d "@data.txt" http://localhost:3000/data 其中data.txt内容如下:param1=value1¶m2=value2 (11.1.2)、POST application/json curl -H "Content-Type:application/json" -X POST -d '{"key1":"value1","key2":"value2"}' http://localhost:3000/data curl -X POST -d "@data.json" http://localhost:3000/data 其中data.json内容如下:{"key1":"value1","key2":"value2"} curl -H "Content-type:application/json" -X POST -d "{\"app_key\":\"$appKey\",\"time_stamp\":\"$time\"}" http://www.test.com.cn/a/b curl -v -H "token: 222" -F "file=@/Users/fungleo/Downloads/401.png" localhost:8000/api/v1/upimg curl -f http://www.linux.com/error (11.3.1)、curl -X POST "http://www.test.com/e/f" -H "Content-Type:application/x-www-form-urlencoded;charset=UTF-8" \ -d "a=b" \ -d "c=d" \ -d "e=f" \ -d "g=h"(11.3.2)、错误:curl -i -G -d "a=b#1&c=d" http://www.test.com/e/f 正确:要把参数值是特殊符号的用urlencode转换过来 curl -i -G -d "a=b%231&c=d" http://www.test.com/e/f curl -v可以显示一次http通信的整个过程,包括端口连接和http request头信息。 如果觉得还不够,那么下面的命令可以查看更详细的通信过程: curl --trace output.txt www.baidu.com 或者 curl --trace-ascii output.txt www.baidu.com 运行后,请打开output.txt文件查看。 curl --trace output.txt http://www.baidu.com curl --trace-ascii output2.txt http://www.baidu.com curl --trace output3.txt --trace-time http://www.baidu.com curl --trace-ascii output4.txt --trace-time http://www.baidu.com举例:有需求每5分钟请求一次http://www.test.com/a/b生成一个日志文件。希望一月的日志(正确的和错误的)能写入一个日志文件 day=`date +%F` logfile='/var/logs/www.test.com_'`date +%Y%m`'.log' /usr/bin/echo -e "\n\n[${day}] Start request \n " >> ${logfile} /bin/curl -v "http://www.test.com/a/b" -d "ccccc" 1>> ${logfile} 2>> ${logfile} --trace-time /usr/bin/echo -e "\n\n[${day}] End request\n" >> ${logfile} curl -f http://www.linux.com/error 本篇文章介绍了Curl.exe的基本使用、进阶使用和高级用法,包括发送HTTP请求、上传文件、模拟登录、设置请求头、进行文件下载、并发测试、API测试、数据分析和数据传输控制等方面。Curl.exe是一个非常实用的命令行工具,可以帮助开发者更好地进行接口测试和数据分析。 到此这篇关于curl.exe安装使用的最全参数详解以及常用命令汇总的文章就介绍到这了,更多相关curl安装使用的常用命令内容请搜索脚本之家以前的文章或继续浏览下面的相关文章希望大家以后多多支持脚本之家! 您可能感兴趣的文章:Linux下命令行cURL的10种常见用法示例Linux 中 CURL常用命令详解PowerShell中使用curl(Invoke-WebRequest)的方法教程linux命令行下使用curl命令查看自己机器的外网ip如:
此参数也可以使用通配符:
(SSL)指定SSL要使用的加密方式;如:“aes_256_sha_256”;
四、
1、下载(option:-o或者option:-O)
1.1、下载页面:
1.2、循环下载
1.3、下载重命名
1.4、分块下载(option:-r)
1.5、通过ftp下载文件(option:-u)
2、上传文件(option:-T)
4、伪造代理设备(模仿浏览器)
5、设置http请求
5.2、指定proxy服务器以及其端口(option::-x)
6、http响应头
6.1、查看http响应头(option:-I)
输出:
7、发送表单数据
8、cookie
8.1、发送cookie(option:-b)
9、测试一个网址
9.1、测试一个网址是否可达
10、保存访问的网页(>>)
11、请求方式
以post请求为例:
使用数据文件的话:
再举个例子:
11.2、-F
11.3、其它举例
12、调试
13、显示抓取错误
四、总结
