php获取网页内容的三种方法
用php代码实现获取网页的原理:
将抓取内容,通过正则表达式过滤,得到想要的内容。
关于正则表达式的内容,脚本学堂介绍了很多,大家可以参考学习下。
php获取内容,方法1,file_get_contents
<?php $url = "http://www.jbxue.com"; $contents = file_get_contents($url); //如果出现中文乱码使用下面代码 //$getcontent = iconv("gb2312", "utf-8",$contents); echo $contents; ?>
php获取网页内容,方法2,curl
<?php $url = "http://www.jbxue.com"; $ch = curl_init(); $timeout = 5; curl_setopt($ch, CURLOPT_URL, $url); curl_setopt($ch, CURLOPT_RETURNTRANSFER, 1); curl_setopt($ch, CURLOPT_CONNECTTIMEOUT, $timeout); //在需要用户检测的网页里需要增加下面两行 //curl_setopt($ch, CURLOPT_HTTPAUTH, CURLAUTH_ANY); //curl_setopt($ch, CURLOPT_USERPWD, US_NAME.":".US_PWD); $contents = curl_exec($ch); curl_close($ch); echo $contents; ?>
php获取网页内容,方法3,fopen->fread->fclose
<?php $handle = fopen ("http://www.jbxue.com", "rb"); $contents = ""; do { $data = fread($handle, 1024); if (strlen($data) == 0) { break; } $contents .= $data; } while(true); fclose ($handle); echo $contents; ?>
注意:
1,使用file_get_contents()和fopen()必须开启allow_url_fopen。
方法:
编辑php.ini,设置 allow_url_fopen = On,allow_url_fopen关闭时,fopen()和file_get_contents()函数,都无法打开远程文件。
2,使用curl(),必须空间开启curl。
方法:
windows下,修改php.ini,将extension=php_curl.dll前面的分号去掉,然后拷贝ssleay32.dll和libeay32.dll到C:\WINDOWS\system32下;
Linux下,安装curl扩展即可。
您可能感兴趣的文章:
php获取网页内容的三种方法
php读取远程文件的三种方法分享
php 获取网站地址的函数代码
php 获取远程网页内容简单函数
python的爬虫是什么意思
php 获取网页内容的四种方法
php页面缓存的例子(减经cpu与mysql负担)
学会php能做什么工作?
PHP计算页面执行时间的代码举例
PHP 获取远程网页内容的代码