我可以使用什么模块来解析Perl CGI脚本中的RSS源?

时间:2010-07-06 15:51:43

标签: perl rss cgi feedparser

我正在尝试找到可以与Perl CGI脚本一起使用的RSS解析器。我找到了simplepie,这是在PHP脚本中使用的非常简单的解析器。不幸的是,这不适用于Perl CGI脚本。如果有任何易于使用的内容,请告诉我simplepie

我遇到了这个问题RssDisplay,但我不确定它的使用情况以及效果如何。

2 个答案:

答案 0 :(得分:6)

来自CPANXML::RSS::Parser

  

XML::RSS::Parser是RSS源的轻量级自由解析器。这个解析器是“自由的”,因为它不要求遵守特定的RSS版本,并且会尝试优雅地处理它不期望或不理解的标签。解析器的唯一要求是文件格式良好的XML并且远程类似于RSS。

#!/usr/bin/perl

use strict; use warnings;

use XML::RSS::Parser;
use FileHandle;

my $parser = XML::RSS::Parser->new;

unless ( -e 'uploads.rdf' ) {
    require LWP::Simple;
    LWP::Simple::getstore(
        'http://search.cpan.org/uploads.rdf',
        'uploads.rdf',
    );
}
my $fh = FileHandle->new('uploads.rdf');
my $feed = $parser->parse_file($fh);

print $feed->query('/channel/title')->text_content, "\n";

my $count = $feed->item_count;
print "# of Items: $count\n";

foreach my $i ( $feed->query('//item') ) {
    print $i->query('title')->text_content, "\n";
}

答案 1 :(得分:1)

可用的Perl模块


  • XML::RSS::Tools

  • XML::RSS::Parser

    #!/usr/bin/perl -w
    use strict;
    
    use XML::RSS::Parser;
    use FileHandle;
    
    my $p = XML::RSS::Parser->new;
    my $fh = FileHandle->new('/path/to/some/rss/file');
    my $feed = $p->parse_file($fh);
    
    # output some values 
    my $feed_title = $feed->query('/channel/title');
    print $feed_title->text_content;
    my $count = $feed->item_count;
    print " ($count)\n";
    foreach my $i ( $feed->query('//item') ) { 
       my $node = $i->query('title');
       print '  '.$node->text_content;
       print "\n"; 
    }  
    
  • XML::RSS::Parser::Lite(Pure Perl):

    use XML::RSS::Parser::Lite;
    use LWP::Simple;
    
    my $xml = get("http://url.to.rss");
    my $rp = new XML::RSS::Parser::Lite;
    $rp->parse($xml);
    
    print join(' ', $rp->get('title'), $rp->get('url'), $rp->get('description')), "\n";
    
    for (my $i = 0; $i < $rp->count(); $i++) {
       my $it = $rp->get($i);
       print join(' ', $it->get('title'), $it->get('url'), $it->get('description')), "\n";
    } 
    
  • dirtyRSS

    use dirtyRSS;
    
    $tree = parse($in);
    die("$tree\n") unless (ref $tree);
    disptree($tree, 0);