ASP

采集原理—采集技术篇—XMLHTTP

最近一段时间,采集很热门,从新闻小偷,到音乐小偷,到新闻采集,Flash采集,都有他的踪影,现在还有很多的人对采集都很感兴趣,为了服务大家,我也正在写一套采集程序,名字为 心意采集程序 ,现在我讲一下,采集用到的相关技术。
下面讲到的也不是很高深的XMLHTTP技术,我也是稍稍讲一下,一个采集需要用到的几块内容
如果你需要了解更多的问题,请去www.google.com 搜索 XMLHTTP 技术 你将会得到更多的帮助,如果大家有什么疑问的话,可以在论坛上回贴
下面只讲到如何在网上得到数据,并不涉及到数据处理
第一 XMLHTTP 技术
http://www.0579.info/study/exploitation/net/58685.htm
上面那个地址,那篇文章讲的根本原理已经很详细了,但是我们一般采集的话,刚开始不太需要了解太多。只要实用就可以了,等以后不够用的时候,再去找相关文档也来得急
首先,我们需要建立一个XMLHTTP对象
微软发布的xmlhttp组件已经有很多的版本了,我知道的就有以下几种:
“MSXML2.ServerXMLHTTP.4.0”
“MSXML2.ServerXMLHTTP.3.0”
“MSXML2.ServerXMLHTTP”
“MSXML2.XMLHTTP.5.0”
“MSXML2.XMLHTTP.4.0”
“MSXML2.XMLHTTP.3.0”
“MSXML2.XMLHTTP”
“Microsoft.XMLHTTP
以上有这么多种组件,我们当然是需要申请最高版本的对象喽,那有什么办法可以实现呢
下面我拿出一段代码,大家可以看看,他是按最高版本申请XMLHTTP对象的

下面我定义一个 路径变量 URL
URL = “http://ent.sina.com.cn/star/mainland/more.html”;
上面是一个网址,如果我们想把上面这个地址采集下来,并显示出来的话,我们可以这样操作
URL = “http://ent.sina.com.cn/star/mainland/more.html”;
Response.Write GetFileText(URL)
这样就可以采集到上面网址的内容了
是不是很简单呢
那采集到数据之后应该怎么操作呢
怎么区分数据,如果得到你想要的数据,如果把得到的数据入库呢
这是以后需要分析讲解的问题了 入库要注意的地方,用正表达式处理数据
附上 上面代码的源文件,大家可以下载下去,运行起来试试,是不是真的能采集到数据库

分类: ASP

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

这个站点使用 Akismet 来减少垃圾评论。了解你的评论数据如何被处理

相关文章

开始在上面输入您的搜索词,然后按回车进行搜索。按ESC取消。

返回顶部