主页 > 知识库 > 一段采集程序代码

一段采集程序代码

热门标签:Linux服务器 服务器配置 阿里云 科大讯飞语音识别系统 银行业务 团购网站 电子围栏 Mysql连接数设置
%@LANGUAGE="JScript" CODEPAGE="936"%>
script language=VBScript runat="Server">
Function bytes2BSTR(vIn)
    strReturn = ""
    For i = 1 To LenB(vIn)
        ThisCharCode = AscB(MidB(vIn,i,1))
        If ThisCharCode  H80 Then
            strReturn = strReturn  Chr(ThisCharCode)
        Else
            NextCharCode = AscB(MidB(vIn,i+1,1))
            strReturn = strReturn  Chr(CLng(ThisCharCode) * H100 + CInt(NextCharCode))
            i = i + 1
        End If
    Next
    bytes2BSTR = strReturn
End Function

Function ajaxRead(theURL)
dim XmlHttp
set XmlHttp = CreateObject("Microsoft.XMLHTTP")
XmlHttp.Open "GET", theURL, false 
XmlHttp.setRequestHeader "Content-Type","text/HTML" 
XmlHttp.Send

dim htmlstr
htmlstr = bytes2BSTR(XmlHttp.responseBody)
ajaxRead = htmlstr
End Function
/script>

%
var ADOConn;
function OpenDatabase(){
        try{
        ADOConn = new ActiveXObject("ADODB.Connection");
        ADOConn.Open ("Provider=Microsoft.Jet.Oledb.4.0;Data Source="+Server.MapPath("getcaiku.mdb"));
        }catch(e){
                ADOConn.close;
                Response.Write("数据库连接出错,请检查连接字串。");
                Response.End;
        }
}

function CloseDatabase(){
        ADOConn.close;
}

Response.Buffer = 1;
Server.ScriptTimeout = 99999;
//////////可修改以下参数////////////////
var beginid = 230;//开始ID
var endid = 500;//结束ID
////////////////////////////////////////
var arr,tstr,tid,getdata;
var countid = 0;
Response.Write ("开始采集:从"+beginid+"到"+endid+"hr>");
Response.Flush;
OpenDatabase();
var re=new RegExp("title>(.*?) - 彩酷/title>","ig");

for(var fi=beginid;fi(endid+1);fi++){
        tid = String(fi);
        getdata = ajaxRead("http://mms.caiku.com/sendcring.aspx?uid=0id="+tid);
        if(arr = re.exec(getdata)!=null){
        tstr = String(RegExp.$1);
        if(tstr!=nulltstr!="undefined"tstr!="")
        tstr = tstr.replace("'","");
        ADOConn.execute("INSERT INTO getdata(title,tid)VALUES('"+tstr+"',"+tid+")");
        Response.Write (tid+":"+tstr+" ___>OK!br>");
        countid++;
        Response.Flush
        }
}
re.close;
CloseDatabase();
Response.Write ("hr>采集完毕!共录入数据"+countid+"条。");
%> 

标签:萍乡 衡水 枣庄 蚌埠 衢州 大理 江苏 广元

巨人网络通讯声明:本文标题《一段采集程序代码》,本文关键词  ;如发现本文内容存在版权问题,烦请提供相关信息告之我们,我们将及时沟通与处理。本站内容系统采集于网络,涉及言论、版权与本站无关。
  • 相关文章
  • 收缩
    • 微信客服
    • 微信二维码
    • 电话咨询

    • 400-1100-266