PHP实现的带超时功能get_headers函数


Posted in PHP onFebruary 10, 2015

代码比较多,但是比较简单,一眼就看穿的,so,文字尽量少写了。
因为众所周知的网络原因,gavatar也开始越来越慢,写了一个小东西来解决这个问题,过程中遇到了get_headers这个函数,甚是忧伤,记录下来,以免后来人踩坑。
更新记录,函数稍微改了一下,返回值基本和之前序列化后的结果一致,暂时没考虑支持子项也支持数组等(考虑细节性能,还想把没用的http头砍掉….)
需求很简单:获取图片的head信息。
调试程序的时候发现这个函数的调用很缓慢,即使绑定ip,有时候都能蹦到20多秒。
寻思这个事情还是该加个超时吧,但是看官方文档,给出的导出函数接口如下:

array get_headers(string$url[,int$format=0])

你没有看错,这个东西没有超时接口…
上github翻看源码,期望可以用他的底层实现来重新实现一套:
地址 https://github.com/php/php-src/blob/88ca46d92bc1c426e7c7f7313f0fd2b7dcc33cf6/ext/standard/url.c#L710
/* {{{ proto array get_headers(string url[, int format])

   fetches all the headers sent by the server in response to a HTTP request */

PHP_FUNCTION(get_headers)

{

char*url;

size_t url_len;

php_stream_context*context;

php_stream*stream;

zval*prev_val,*hdr=NULL,*h;

HashTable*hashT;

zend_long format=0;

                

if(zend_parse_parameters(ZEND_NUM_ARGS()TSRMLS_CC,"s|l",&url,&url_len,&format)==FAILURE){

return;

}

 

/** 省略其他一堆... **/

}

/* }}} */

但是很不幸的是,zend_parse_parameters 和 ZEND_NUM_ARGS也都没有PHP版的导出函数。
于是造轮子开始:

functionget_url_headers($url,$timeout=10)

{

    $ch=curl_init();

 

    curl_setopt($ch,CURLOPT_URL,$url);

    curl_setopt($ch,CURLOPT_HEADER,true);

    curl_setopt($ch,CURLOPT_NOBODY,true);

    curl_setopt($ch,CURLOPT_RETURNTRANSFER,true);

    curl_setopt($ch,CURLOPT_TIMEOUT,$timeout);

 

    $data=curl_exec($ch);

    $data=preg_split('/\n/',$data);

 

    $data=array_filter(array_map(function($data){

        $data=trim($data);

        if($data){

            $data=preg_split('/:\s/',trim($data),2);

            $length=count($data);

            switch($length){

                case2:

                    returnarray($data[0]=>$data[1]);

                    break;

                case1:

                    return$data;

                    break;

                default:

                    break;

            }

        }

    },$data));

 

    sort($data);

 

    foreach($dataas$key=>$value){

        $itemKey=array_keys($value)[0];

        if(is_int($itemKey)){

            $data[$key]=$value[$itemKey];

        }elseif(is_string($itemKey)){

            $data[$itemKey]=$value[$itemKey];

            unset($data[$key]);

        }

    }

 

    return$data;

}

对比最后结果:
原版又是蛮长的等待,不知道校验啥去了(没继续追代码了,有兴趣的童鞋可以去跟下玩):

Array

(

    [0]=>HTTP/1.0302Found

    [Accept-Ranges]=>bytes

    [Cache-Control]=>max-age=300

    [Content-Type]=>Array

        (

            [0]=>text/html;charset=utf-8

            [1]=>text/html;charset=utf-8

        )

 

    [Date]=>Array

        (

            [0]=>Fri,12Dec201415:35:40GMT

            [1]=>Fri,12Dec201415:35:43GMT

        )

 

    [Expires]=>Fri,12Dec201415:40:40GMT

    [Last-Modified]=>Wed,11Jan198408:00:00GMT

    [Link]=><http://www.gravatar.com/avatar/[省略...]?s=42&d=http%3A%2F%2F[省略...]&r=G>; rel="canonical"

    [Location]=>http://i2.wp.com/[省略...]

    [Server]=>Array

        (

            [0]=>ECS(oxr/838B)

            [1]=>nginx

        )

 

    [Source-Age]=>85

    [Via]=>1.1varnish

    [X-Cache]=>302-HIT

    [X-Varnish]=>14702550881470006304

    [Content-Length]=>0

    [Connection]=>Array

        (

            [0]=>close

            [1]=>close

        )

 

    [1]=>HTTP/1.1504Gateway Timeout

)

轮子版返回(瞬间返回,两者内容略有不同,你仔细看就能发现一些有趣的地方了):

Array

(

    [0]=>HTTP/1.1302Found

    [Accept-Ranges]=>bytes

    [Via]=>1.1varnish

    [Cache-Control]=>max-age=300

    [Server]=>ECS(oxr/838B)

    [Content-Type]=>text/html;charset=utf-8

    [X-Varnish]=>14702550881470006304

    [Date]=>Fri,12Dec201420:31:02GMT

    [Location]=>http://i2.wp.com/[省略...]

    [Expires]=>Fri,12Dec201420:36:02GMT

    [Source-Age]=>85

    [Last-Modified]=>Wed,11Jan198408:00:00GMT

    [X-Cache]=>302-HIT

    [Link]=><http://www.gravatar.com/avatar/[省略...]?s=42&d=http%3A%2F%2F[省略...]&r=G>; rel="canonical"

    [Content-Length]=>0

)
PHP 相关文章推荐
PHP 第二节 数据类型之字符串类型
Apr 28 PHP
php字符串分割函数explode的实例代码
Feb 07 PHP
浅析PHP递归函数返回值使用方法
Feb 18 PHP
thinkphp实现多语言功能(语言包)
Mar 04 PHP
php中preg_match的isU代表什么意思
Oct 01 PHP
win平台安装配置Nginx+php+mysql 环境
Jan 12 PHP
PHP中类属性与类静态变量的访问方法示例
Jul 13 PHP
PHP入门教程之日期与时间操作技巧总结(格式化,验证,获取,转换,计算等)
Sep 11 PHP
PHP实现在对象之外访问其私有属性private及保护属性protected的方法
Nov 20 PHP
深入研究PHP中的preg_replace和代码执行
Aug 15 PHP
PHP+jQuery实现即点即改功能示例
Feb 21 PHP
PHP下用Swoole实现Actor并发模型的方法
Jun 12 PHP
Laravel框架中实现使用阿里云ACE缓存服务
Feb 10 #PHP
Laravel中扩展Memcached缓存驱动实现使用阿里云OCS缓存
Feb 10 #PHP
PHP框架Laravel的小技巧两则
Feb 10 #PHP
Laravel模板引擎Blade中section的一些标签的区别介绍
Feb 10 #PHP
Laravel 5.0 发布 新版本特性详解
Feb 10 #PHP
PHP转盘抽奖接口实例
Feb 09 #PHP
PHP积分兑换接口实例
Feb 09 #PHP
You might like
BBS(php &amp; mysql)完整版(六)
2006/10/09 PHP
PHP和Mysqlweb应用开发核心技术 第1部分 Php基础-1 开始了解php
2011/07/03 PHP
PHP进行批量任务处理不超时的解决方法
2016/07/11 PHP
ThinkPHP5.1框架页面跳转及修改跳转页面模版示例
2019/05/06 PHP
javascript setTimeout()传递函数参数(包括传递对象参数)
2010/04/07 Javascript
jqTransform form表单美化插件使用方法
2012/07/05 Javascript
在JavaScript中实现类的方式探讨
2013/08/28 Javascript
图片上传插件jquery.uploadify详解
2013/11/15 Javascript
JavaScript实现常用二级省市级联下拉列表的方法
2015/03/25 Javascript
js操作数组函数实例小结
2015/12/10 Javascript
利用jQuery中的ajax分页实现代码
2016/02/25 Javascript
Javascript的比较汇总
2016/07/25 Javascript
微信小程序 配置文件详细介绍
2016/12/14 Javascript
Bootstrap的modal拖动效果
2016/12/25 Javascript
javascript 正则表达式去空行方法
2017/01/24 Javascript
angularJS+requireJS实现controller及directive的按需加载示例
2017/02/20 Javascript
setTimeout函数的神奇使用
2017/02/26 Javascript
详解Node.js串行化流程控制
2017/05/04 Javascript
jQuery返回定位插件详解
2017/05/15 jQuery
Vue组件选项props实例详解
2017/08/18 Javascript
微信小程序实现全国机场索引列表
2018/01/31 Javascript
通过实例学习React中事件节流防抖
2019/06/17 Javascript
vue 集成 vis-network 实现网络拓扑图的方法
2019/08/07 Javascript
python-opencv在有噪音的情况下提取图像的轮廓实例
2017/08/30 Python
python 接口返回的json字符串实例
2018/03/27 Python
将Dataframe数据转化为ndarry数据的方法
2018/06/28 Python
详解numpy的argmax的具体使用
2019/05/27 Python
python新式类和经典类的区别实例分析
2020/03/23 Python
python 使用多线程创建一个Buffer缓存器的实现思路
2020/07/02 Python
移动web模拟客户端实现多方框输入密码效果【附代码】
2016/03/25 HTML / CSS
Bravofly德国:预订廉价航班和酒店
2019/09/22 全球购物
学生上课说话检讨书
2014/10/25 职场文书
2015清明节祭奠英烈寄语大全
2015/03/04 职场文书
2016应届毕业生实习评语
2015/12/01 职场文书
导游词之广东佛山(南风古灶)
2019/09/24 职场文书
Python实现照片卡通化
2021/12/06 Python