网页表格抓取(用Perl网页和提交表格这里简单的模块介绍)

优采云 发布时间: 2021-11-30 22:21

  网页表格抓取(用Perl网页和提交表格这里简单的模块介绍)

  本文文章主要介绍如何使用Perl抓取网页和提交表单。有一定的参考价值。有兴趣的朋友可以参考一下。希望大家看完这篇文章收获,带你一探究竟。

  使用 Perl 抓取网页并提交表单

  这里简单介绍一下使用Perl捕获网页源代码,以及使用POST方法提交表单并返回结果。我不能说难的,只说简单的。

  这里提到的 Perl 模块是:

  useLWP::Simple;useLWP::UserAgent;使用 Perldoc 查看详细用法。

  1、使用Perl抓取网页

  如果你只是想获取某个网页,使用LWP::Simple中的功能是最简单的。通过调用get($url)函数,可以获得相关URL的内容。

  my$url='http://freshair.npr.org/dayFA.cfm?todayDate=current'  useLWP::Simple;  my$content=get$url;  die"Couldn'tget$url"unlessdefined$content;

  #$content 是网页的内容,这里是对这个内容的一些分析:

  if($content=~m/jazz/i){  print"They'retalkingaboutjazztodayonFreshAir!\n";  }else{  print"FreshAirisapparentlyjazzlesstoday.\n";  }

  非常简单易懂。获取一个网页的内容很容易,但难的是有规律地过滤出需要的内容。

  2、通过POST提交表单

  某些 HTML 表单使用 HTMLPOST 向服务器提交数据,您可以在这里这样做:

  $response=$browser->post($url,  [  formkey1=>value1,  formkey2=>value2,  ...  ],  );

  案例分析:比如提交一个序列并返回结果,使用Perl来实现。代码如下:

  #!/usr/bin/Perl   useLWP::UserAgent;  my$browser=LWP::UserAgent->new;  $protein="MSSSTPFDPYALSEHDEERPQNVQSKSRTAELQAEIDDTVGIMRDNINKVAERGERLTSI";  my$SUSUI_URL="http://www.enzim.hu/hmmtop/server/hmmtop.cgi";  my$response=$browser->post($SUSUI_URL,['if'=>$protein,]);   if($response->is_success){   print$response->content;  }else{   print"Badluckthistime\n";  }

  通过分析页面,我们可以看到只有一个input需要提交,就是name="if"。 $protein 是要提交的序列。 $response->content 是返回结果。

  感谢您仔细阅读这篇文章,也希望文章编者分享的《如何使用Perl抓取网页和提交表单》对大家有所帮助,也希望大家全部支持易速云,关注易速云行业资讯频道,更多相关知识等你学习!

0 个评论

要回复文章请先登录注册


官方客服QQ群

微信人工客服

QQ人工客服


线