用户注册



邮箱:

密码:

用户登录


邮箱:

密码:
记住登录一个月忘记密码?

发表随想


还能输入:200字
云代码 - perl代码库

perl 查找过期链接

2012-10-15 作者: 神马举报

[perl]代码库

#-----------------------------
# download the following standalone program
#!/usr/bin/perl -w
# churl - check urls

use HTML::LinkExtor;
use LWP::Simple qw ( get head );

$base_url = shift
            or die "usage: $0 <start_url>\n";
$parser = HTML::LinkExtor->new ( undef, $base_url );
$parser->parse ( get ( $base_url ) );
@links = $parser->links;
print "$base_url: \n";
foreach $linkarray ( @links )
{
	my @element  = @$linkarray;
	my $elt_type = shift @element;
	while ( @element )
	{
		my ( $attr_name , $attr_value ) = splice ( @element, 0, 2 );
		if ( $attr_value->scheme =~ /\b ( ftp|https?|file ) \b/ )
		{
			print "  $attr_value: ", head ( $attr_value ) ? "OK" : "BAD", "\n";
		}
	}
}

#-----------------------------
#% churl http://www.wizards.com
#http://www.wizards.com:
#
#  FrontPage/FP_Color.gif:  OK
#
#  FrontPage/FP_BW.gif:  BAD
#
#  #FP_Map:  OK
#
#  Games_Library/Welcome.html:  OK
#-----------------------------


网友评论    (发表评论)

共1 条评论 1/1页

发表评论:

评论须知:

  • 1、评论每次加2分,每天上限为30;
  • 2、请文明用语,共同创建干净的技术交流环境;
  • 3、若被发现提交非法信息,评论将会被删除,并且给予扣分处理,严重者给予封号处理;
  • 4、请勿发布广告信息或其他无关评论,否则将会删除评论并扣分,严重者给予封号处理。


扫码下载

加载中,请稍后...

输入口令后可复制整站源码

加载中,请稍后...