使用PHP的cURL库可以简朴和有用地去抓网页。你只需要运行一个剧本,然后剖析一下你所抓取的网 页,然后就可以以程序的方式获得你想要的数据了。无论是你想从从一个链接上取部门数据,或是取一个XML文件并把其导入数据库,那怕就是简朴的获取网页内 容,cURL 是一个功效壮大的PHP库。 PHP中的CURL函数库(Client URL Library Function) curl_close — 关闭一个curl会话 curl_copy_handle — 拷贝一个curl毗邻资源的所有内容和参数 curl_errno — 返回一个包罗当前会话错误信息的数字编号 curl_error — 返回一个包罗当前会话错误信息的字符串 curl_exec — 执行一个curl会话 curl_getinfo — 获取一个curl毗邻资源句柄的信息 curl_init — 初始化一个curl会话 curl_multi_add_handle — 向curl批处置会话中添加单独的curl句柄资源 curl_multi_close — 关闭一个批处置句柄资源 curl_multi_exec — 剖析一个curl批处置句柄 curl_multi_getcontent — 返回获取的输出的文本流 curl_multi_info_read — 获取当前剖析的curl的相关传输信息 curl_multi_init — 初始化一个curl批处置句柄资源 curl_multi_remove_handle — 移除curl批处置句柄资源中的某个句柄资源 curl_multi_select — Get all the sockets associated with the cURL extension, which can then be "selected" curl_setopt_array — 以数组的形式为一个curl设置会话参数 curl_setopt — 为一个curl设置会话参数 curl_version — 获取curl相关的版本信息 curl_init()函数的作用初始化一个curl会话,curl_init()函数唯一的一个参数是可选的,示意一个url地址。 curl_exec()函数的作用是执行一个curl会话,唯一的参数是curl_init()函数返回的句柄。 curl_close()函数的作用是关闭一个curl会话,唯一的参数是curl_init()函数返回的句柄。 例子一: 基本例子 基本例子 ﹤?php // 初始化一个 cURL 工具 $curl = curl_init(); // 设置你需要抓取的URL curl_setopt($curl, CURLOPT_URL, 'http://www.genban.org'); // 设置header curl_setopt($curl, CURLOPT_HEADER, 1); // 设置cURL 参数,php require_once的使用方法总结
require_once 语句和 require 语句完全相同,唯一区别是 PHP 会检查该文件是否已经被包含过,如果是则不会再次包含。 参见 include_once 的文档来理解 _once 的含义,并理解与没
要求效果保留到字符串中照样输出到屏幕上。 curl_setopt($curl, CURLOPT_RETURNTRANSFER, 1); // 运行cURL,请求网页 $data = curl_exec($curl); // 关闭URL请求 curl_close($curl); // 显示获得的数据 var_dump($data); ?> 例子二: POST数据 sendSMS.php,其可以接受两个表单域,一个是电话号码,一个是短信内容。 POST数据 ﹤?php $phoneNumber = '13812345678'; $message = 'This message was generated by curl and php'; $curlPost = 'pNUMBER=' . urlencode($phoneNumber) . '&MESSAGE=' . urlencode($message) . '&SUBMIT=Send'; $ch = curl_init(); curl_setopt($ch, CURLOPT_URL, 'http://www.genban.org/sendSMS.php'); curl_setopt($ch, CURLOPT_HEADER, 1); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); curl_setopt($ch, CURLOPT_POST, 1); curl_setopt($ch, CURLOPT_POSTFIELDS, $curlPost); $data = curl_exec(); curl_close($ch); ?﹥ 例子三:使用署理服务器 使用署理服务器 ﹤?php $ch = curl_init(); curl_setopt($ch, CURLOPT_URL, 'http://www.genban.org'); curl_setopt($ch, CURLOPT_HEADER, 1); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); curl_setopt($ch, CURLOPT_HTTPPROXYTUNNEL, 1); curl_setopt($ch, CURLOPT_PROXY, 'proxy.genban.org:1080'); curl_setopt($ch, CURLOPT_PROXYUSERPWD, 'user:password'); $data = curl_exec(); curl_close($ch); ?﹥ 例子四: 模拟登录 Curl 模拟登录 discuz 程序,适合DZ7.0,将username改成你的用户名,userpass改成你的密码就可以了. Curl 模拟登录 discuz 程序 <?php !extension_loaded('curl') && die('The curl extension is not loaded.'); $discuz_url = 'http://www.genban.org';//论坛地址 $login_url = $discuz_url .'/logging.php?action=login';//登录页地址 $get_url = $discuz_url .'/my.php?item=threads'; //我的帖子 $post_fields = array(); //以下两项不需要修改 $post_fields['loginfield'] = 'username'; $post_fields['loginsubmit'] = 'true'; //用户名和密码,必须填写 $post_fields['username'] = 'lxvoip'; $post_fields['password'] = '88888888'; //平安提问 $post_fields['questionid'] = 0; $post_fields['answer'] = ''; //@todo验证码 $post_fields['seccodeverify'] = ''; //获取表单FORMHASH $ch = curl_init($login_url); curl_setopt($ch, CURLOPT_HEADER, 0); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); $contents = curl_exec($ch); curl_close($ch); preg_match('/<input\s*type="hidden"\s*name="formhash"\s*value="(.*?)"\s*\/>/i', $contents, $matches); if(!empty($matches)) { $formhash = $matches[1]; } else { die('Not found the forumhash.'); } //POST数据,获取COOKIE $cookie_file = dirname(__FILE__) . '/cookie.txt'; //$cookie_file = tempnam('/tmp'); $ch = curl_init($login_url); curl_setopt($ch, CURLOPT_HEADER, 0); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); curl_setopt($ch, CURLOPT_POST, 1); curl_setopt($ch, CURLOPT_POSTFIELDS, $post_fields); curl_setopt($ch, CURLOPT_COOKIEJAR, $cookie_file); curl_exec($ch); curl_close($ch); //带着上面获得的COOKIE获取需要登录后才气查看的页面内容 $ch = curl_init($get_url); curl_setopt($ch, CURLOPT_HEADER, 0); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 0); curl_setopt($ch, CURLOPT_COOKIEFILE, $cookie_file); $contents = curl_exec($ch); curl_close($ch); var_dump($contents); //上传文件 $file = 'file'; //要上传的文件 $url = 'url';//target url $fields['f'] = '@'.$file; $ch = curl_init(); curl_setopt($ch, CURLOPT_URL, $url ); curl_setopt($ch, CURLOPT_POST, 1 ); curl_setopt($ch, CURLOPT_POSTFIELDS, $fields ); curl_exec( $ch ); if ($error = curl_error($ch) ) { die($error); } curl_close($ch); 这里说明一下CURLOPT_POSTFIELDS这个参数若是是POST字符串时,可以用形如“name=value&...”的字符串,若是post文件,就必须要用数组,而且文件名花样为"@绝对路径",这是 CURL 会帮你做 multipart/form-data 编码。 <?php $ch = curl_init(); curl_setopt($ch, CURLOPT_HEADER, 0); curl_setopt($ch, CURLOPT_VERBOSE, 0); curl_setopt($ch, CURLOPT_RETURNTRANSFER, true); curl_setopt($ch, CURLOPT_USERAGENT, "Mozilla/4.0 (compatible;)"); curl_setopt($ch, CURLOPT_URL, _VIRUS_SCAN_URL); curl_setopt($ch, CURLOPT_POST, true); // same as <input type="file" name="file_box"> $post = array( "file_box"=>"@/path/to/myfile.jpg", ); curl_setopt($ch, CURLOPT_POSTFIELDS, $post); $response = curl_exec($ch); ?>用百度AI的OCR文字识别结合PHP实现了图片的文字识别功能
第一步可定要获取百度的三个东西 要到百度AI网站(http://ai.baidu.com/)去注册 然后获得 -const APP_ID = '请填写你的appid'; -const API_KEY = '请填
企业建站必须了解的内容:网站空间
当下互联网+深入人心,各行各业纷纷亲密触网已成大趋势,一个线上的“门店”——官方网站,成了很多企业转型的“必需品”。但问题来了,建好一个网