网页表格抓取(用Perl网页和提交表格这里简单的模块介绍)
优采云 发布时间: 2021-11-30 22:21网页表格抓取(用Perl网页和提交表格这里简单的模块介绍)
本文文章主要介绍如何使用Perl抓取网页和提交表单。有一定的参考价值。有兴趣的朋友可以参考一下。希望大家看完这篇文章收获,带你一探究竟。
使用 Perl 抓取网页并提交表单
这里简单介绍一下使用Perl捕获网页源代码,以及使用POST方法提交表单并返回结果。我不能说难的,只说简单的。
这里提到的 Perl 模块是:
useLWP::Simple;useLWP::UserAgent;使用 Perldoc 查看详细用法。
1、使用Perl抓取网页
如果你只是想获取某个网页,使用LWP::Simple中的功能是最简单的。通过调用get($url)函数,可以获得相关URL的内容。
my$url='http://freshair.npr.org/dayFA.cfm?todayDate=current' useLWP::Simple; my$content=get$url; die"Couldn'tget$url"unlessdefined$content;
#$content 是网页的内容,这里是对这个内容的一些分析:
if($content=~m/jazz/i){ print"They'retalkingaboutjazztodayonFreshAir!\n"; }else{ print"FreshAirisapparentlyjazzlesstoday.\n"; }
非常简单易懂。获取一个网页的内容很容易,但难的是有规律地过滤出需要的内容。
2、通过POST提交表单
某些 HTML 表单使用 HTMLPOST 向服务器提交数据,您可以在这里这样做:
$response=$browser->post($url, [ formkey1=>value1, formkey2=>value2, ... ], );
案例分析:比如提交一个序列并返回结果,使用Perl来实现。代码如下:
#!/usr/bin/Perl useLWP::UserAgent; my$browser=LWP::UserAgent->new; $protein="MSSSTPFDPYALSEHDEERPQNVQSKSRTAELQAEIDDTVGIMRDNINKVAERGERLTSI"; my$SUSUI_URL="http://www.enzim.hu/hmmtop/server/hmmtop.cgi"; my$response=$browser->post($SUSUI_URL,['if'=>$protein,]); if($response->is_success){ print$response->content; }else{ print"Badluckthistime\n"; }
通过分析页面,我们可以看到只有一个input需要提交,就是name="if"。 $protein 是要提交的序列。 $response->content 是返回结果。
感谢您仔细阅读这篇文章,也希望文章编者分享的《如何使用Perl抓取网页和提交表单》对大家有所帮助,也希望大家全部支持易速云,关注易速云行业资讯频道,更多相关知识等你学习!