在php中cURL库函数可以通过URL地址轻松获取网页内容,实现网页内容抓取功能。
一、开启cURL库的方法
那么如何开启cURL功能呢?下面是开启此功能的方法:1:打开PHP.ini,然后找到extension=php_curl.dll 这句话 然后把前面的;去掉,再重启apache服务;2:如果上第1条已经设置,还是无法检测到curl_init,则检查php.ini的extension_dir值是哪个目录,以及php下的ext目录是否有无php_curl.dll,没有的请下载php_curl.dll;3:再把php目录中的libeay32.dll,ssleay32.dll拷到c:/windows/system32里面;4:重启下 apache;5:如果apache重启后还是无法启动curl_init,那么你就得考虑PHP系统环境变量的配置是否出问题;6:如果没有配置则要加上系统环境变量的配置。点击我的电脑,右键->属性->环境变量->系统变量->path路径。在path路径上加上php的目录路径。例如我的(D:/Wamp2/php5.4;D:/Wamp2/php5.4/ext;),注意用分号隔开。7:重启系统,重启apache;
二、cURL库函数的使用方法
cURL 是一个功能强大的PHP库,下面介绍一下这个库的使用。
PHP中的CURL函数库(Client URL Library Function)curl_close — 关闭一个curl会话curl_copy_handle — 拷贝一个curl连接资源的所有内容和参数curl_errno — 返回一个包含当前会话错误信息的数字编号curl_error — 返回一个包含当前会话错误信息的字符串curl_exec — 执行一个curl会话curl_getinfo — 获取一个curl连接资源句柄的信息curl_init — 初始化一个curl会话curl_multi_add_handle — 向curl批处理会话中添加单独的curl句柄资源curl_multi_close — 关闭一个批处理句柄资源curl_multi_exec — 解析一个curl批处理句柄curl_multi_getcontent — 返回获取的输出的文本流curl_multi_info_read — 获取当前解析的curl的相关传输信息curl_multi_init — 初始化一个curl批处理句柄资源curl_multi_remove_handle — 移除curl批处理句柄资源中的某个句柄资源curl_multi_select — Get all the sockets associated with the cURL extension, which can then be "selected"curl_setopt_array — 以数组的形式为一个curl设置会话参数curl_setopt — 为一个curl设置会话参数curl_version — 获取curl相关的版本信息curl_init()函数的作用初始化一个curl会话,curl_init()函数唯一的一个参数是可选的,表示一个url地址。curl_exec()函数的作用是执行一个curl会话,唯一的参数是curl_init()函数返回的句柄。curl_close()函数的作用是关闭一个curl会话,唯一的参数是curl_init()函数返回的句柄。
三、cURL库运用案例:
例子一: 基本例子基本例子
﹤?php// 初始化一个 cURL 对象$curl = curl_init();// 设置你需要抓取的URLcurl_setopt($curl, CURLOPT_URL, 'http://www.cmx8.cn');// 设置headercurl_setopt($curl, CURLOPT_HEADER, 1);// 设置cURL 参数,要求结果保存到字符串中还是输出到屏幕上。curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1);// 运行cURL,请求网页$data = curl_exec($curl);// 关闭URL请求curl_close($curl);// 显示获得的数据var_dump($data);?>例子二: POST数据
sendSMS.php,其可以接受两个表单域,一个是电话号码,一个是短信内容。POST数据
﹤?php$phoneNumber = '13812345678';$message = 'This message was generated by curl and php';$curlPost = 'pNUMBER=' . urlencode($phoneNumber) . '&MESSAGE=' . urlencode($message) . '&SUBMIT=Send';$ch = curl_init();curl_setopt($ch, CURLOPT_URL, 'http://www.lxvoip.com/sendSMS.php');curl_setopt($ch, CURLOPT_HEADER, 1);curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);curl_setopt($ch, CURLOPT_POST, 1);curl_setopt($ch, CURLOPT_POSTFIELDS, $curlPost);$data = curl_exec();curl_close($ch);?﹥例子三:使用代理服务器使用代理服务器
﹤?php $ch = curl_init();curl_setopt($ch, CURLOPT_URL, 'http://www.cmx8.cn');curl_setopt($ch, CURLOPT_HEADER, 1);curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1);curl_setopt($ch, CURLOPT_HTTPPROXYTUNNEL, 1);curl_setopt($ch, CURLOPT_PROXY, 'proxy.lxvoip.com:1080');curl_setopt($ch, CURLOPT_PROXYUSERPWD, 'user:passWord');$data = curl_exec();curl_close($ch);?﹥例子四: 模拟登录
Curl 模拟登录 discuz程序,适合DZ7.0,将username改成你的用户名,userpass改成你的密码就可以了.Curl 模拟登录 discuz 程序<?php !extension_loaded('curl') &&die('The curl extension is notloaded.'); $discuz_url ='http://www.lxvoip.com';//论坛地址 $login_url = $discuz_url.'/logging.php?action=login';//登录页地址 $get_url = $discuz_url .'/my.php?item=threads';//我的帖子 $post_fields =array(); //以下两项不需要修改 $post_fields['loginfield'] ='username'; $post_fields['loginsubmit'] ='true'; //用户名和密码,必须填写 $post_fields['username'] ='lxvoip'; $post_fields['password'] ='88888888'; //安全提问 $post_fields['questionid'] =0; $post_fields['answer'] =''; //@todo验证码 $post_fields['seccodeverify'] =''; //获取表单FORMHASH $ch =curl_init($login_url); curl_setopt($ch, CURLOPT_HEADER,0); curl_setopt($ch, CURLOPT_RETURNTRANSFER,1); $contents =curl_exec($ch); curl_close($ch); preg_match('/<input/s*type="hidden"/s*name="formhash"/s*value="(.*?)"/s*//>/i',$contents,$matches); if(!empty($matches)){ $formhash =$matches[1]; } else{ die('Notfound theforumhash.'); } //POST数据,获取COOKIE $cookie_file = dirname(__FILE__) .'/cookie.txt'; //$cookie_file =tempnam('/tmp'); $ch =curl_init($login_url); curl_setopt($ch, CURLOPT_HEADER,0); curl_setopt($ch, CURLOPT_RETURNTRANSFER,1); curl_setopt($ch, CURLOPT_POST,1); curl_setopt($ch, CURLOPT_POSTFIELDS,$post_fields); curl_setopt($ch, CURLOPT_COOKIEJAR,$cookie_file); curl_exec($ch); curl_close($ch); //带着上面得到的COOKIE获取需要登录后才能查看的页面内容 $ch =curl_init($get_url); curl_setopt($ch, CURLOPT_HEADER,0); curl_setopt($ch, CURLOPT_RETURNTRANSFER,0); curl_setopt($ch, CURLOPT_COOKIEFILE,$cookie_file); $contents =curl_exec($ch); curl_close($ch); var_dump($contents); ?>新闻热点
疑难解答
图片精选