我用simple_html_dom 爬取网页,用的面向对象方式,但是会出现超时的情况。
set_time_limit(10000);
ini_set('default_socket_timeout', 5);
$context = stream_context_create(
array(
'http'=>array(
'method' => 'GET',
'timeout' => 5
),
)
);
$shd->load_file($player_url, false, $contex);
我用上面的代码做限时处理,可是不起作用。当时间超过10000秒时会退出脚本,但是我希望一条请求超时后会终止这条请求,然后重新发起请求或进行下一条请求。大神有好的办法么?
不要直接使用它提供的接口获取网络上的内容,虽然它具备这个能力,但这也只是给你调试的时候使用的。在真实情况下很容易碰到如你问题中所述的超时情况,所以你最好先用
curl
接口来获取内容,然后再用simple_html_dom
来处理这个内容,前者可以很方便地处理各种网络错误