相关推荐
-
从搜索引擎或者具体网页上提取链接
[软件功能]: 本软件用于从搜索引擎或者具体网页上提取链接,主要用途是搜索留言本、论坛、blog等地址 通过您设定的关键词 软件自动在搜索引擎结果里提取符合条件的连接 本软件把超链接分为两部分看待:连接和连接名称 通过对这两部分的设定来提取符合要求的连接 可以设定只提取含有某“特征词”的网址 也可以设定过滤含有某“特征词”的网址(针对链接) 可以设定只提取链接名称含有某“特征词”的网址 也可以设定过滤链接名称含有某“特征词”的网址(针对链接名称) 提取搜索结果是一门技术,需要一定的电脑和网络基础,本软件是为懂电脑和网络的人设计的 本软件是免费软件,不对外提供服务(本人的全系列客户除外) [参数说明]: 本软使用的关键在于正确设置各项参数,参数设置对了,链接也就提出来了 关键词或网址:如果从搜索引擎里提取 就填写关键词 比如 签写留言(提取留言本) 、Powered by Discuz(提取discuz类型的论坛) 如果是从某页面提取 就填写完整的网址 比如 http://club.sohu.com/map/club_map.htm 链接必含词汇: 就是规定提出来的链接必须含有什么词汇 比如提取留言本 就可以设定 wbook.asp、gb_sign.asp、upfile.asp、feedback.asp 这些常用的留言本文件名称 也可以留空,表示所有的网址都要 链接排除词汇:如果你不希望提取的网址含有某个词汇 就写上 这个一般不要动,不要修改默认的,更不能留空 链连名称必含: 就是提取连接时,链接名称里面必须含有的词汇 这个一般不要动,留空即可 链连名称排除: 就是提取连接时,链接名称里面不能含有的词汇 这个一般不要动,不要修改默认的,更不能留空 间隔或者限时:因为google禁止连续不停的快速搜索,所以本软件对百度和google采用不同的方式提取 对百度是连续性的 对google是固定间隔时间的不断提取 限时: 处理某一个页面允许的最长时间 超过限时就刷新重试 (针对百度) 间隔: 隔多久提取下一页(针对google,默认15秒,尽量不要修改) 过滤相似: 这个参数对应着搜索引擎的两种搜索模式,一般都要选上它,不熟悉搜索引擎的不要改 设置好各项参数后点击<提取>按钮即可,软件开始提取, 软件左下角会显示进度,提取完了会显示提取完毕 举例说明: 一、如果想从搜索引擎里提取某些网址 A.比如想提取一些留言本地址 首先 选择要用的搜索引擎(百度或者google) 然后输入关键字“签写留言” --如要教育类的留言本,就输“签写留言 教育” --如不要带验证码的就输“签写留言 教育 -验证码” 关键词选择学问很大,需仔细琢磨 其次选择链接必含词汇 --词汇那儿可以不填,这样可以提取出所有类型的留言本 --如果需要某一类型的留言本,就填上该类型的留言本地址中都有的词汇 比如 "write.asp"、"upfile.asp"、"leaveword.asp"、"add.asp"等等 其它参数可以不动 最后点<提取>按钮。软件就开始搜索,并不断把搜索到的相关网址添加到左边列 同时列表下方会显示提取了多少页,直到全部页面提取完毕。 B.比如想提取一些动网论坛地址 请先选择要用的搜索引擎(百度和google),然后输入关键字“Powered By Dvbbs”。 因为大多数论坛地址都含有“bbs”,所以你可以设定"bbs"为必含词汇,也可以不输入 其它参数可以不动。 直接点<提取>按钮。软件就开始搜索,并不断把搜索到的相关网址添加到左边列表里 同时列表下方会显示提取了多少页,直到全部页面提取完毕。 二、如果想从某具体网页上提取某些网址 请先输入该网页完整的具体网址 然后输入要提取的网址里面必含词汇,也可以输入排除词汇 然后点提取即可把你想要的网址一次性提出来。 比如想要搜狐论坛列表 http://club.sohu.com/map/club_map.htm 里的所有论坛栏目地址 首先输入网址 http://club.sohu.com/map/club_map.htm 我们可以发现该页面上论坛栏目地址都含有list这个词,所以把“list”作为必含词汇 然后点<提取>按钮,就可以把所有的搜狐论坛栏目地址都提出来了 注意事项: a.如果想提取全部网址,只需把必含词汇设为“http”或者留空 b.用不同特征词从搜索引擎提取某一类网址时,链接排除词汇的设定可以避免重复提取 c.一般情况下不要改动排除词汇的设定,默认设置不影响正常提取
-
一个可以搜索页面内超链接的HTML页面
页面效果如上,含有标题,搜索框和一些超链接,在搜索框输入一些文字可以在下方显示含有这些文字的超链接。这里的搜索不仅可以中文,还可以是英文,数字。
-
HTML对象库简介(Microsoft HTML Object Library -> mshtml.tlb)
获取网页数据必须使用HTML对 象库,可在“引用”窗体中添加对“Microsoft HTML Object Library”的引用。HTML对象库提供了大量的对象,这些对象和各类HTML标记相对应,如熟悉的“”、 “”、“”和“”标记,一些常用HTML对象的知识点如下所述: (1)HTMLAnchorElement对象:该对象代表网页中超级链接(即“”)标记,其常用属性和方法如下所述: href属性:该属性用于设置链接的目标。
-
利用WebBorwser和MSHTML.tlb做广告过滤器完全源码公开
google_ad_client = "pub-2947489232296736";/* 728x15, 创建于 08-4-23MSDN */google_ad_slot = "3624277373";google_ad_width = 728;google_ad_height = 15;//<script type="text/javascript"
-
vb microsoft html object library,HTML对象库简介(Microsoft HTML Object Library -> mshtml.tlb)...
获取网页数据必须使用HTML对象库,可在“引用”窗体中添加对“Microsoft HTML Object Library”的引用。HTML对象库提供了大量的对象,这些对象和各类HTML标记相对应,如熟悉的“”、 “”、“< body>”和“”标记,一些常用HTML对象的知识点如下所述: (1)HTMLAnchorElement对象:该对象代表网页中超级链接(即“”)标记,其常用属性...
-
添加mshtml.tlb的警告
针对以下两种警告: warning C4192: 导入类型库“wireHDC”时自动排除“mshtml.tlb”。 warning C4278: “TranslateAccelerator”: 类型库“mshtml.tlb”中的标识符已经是宏;使用“rename”限定符。 方法: #import &lt;mshtml.tlb&gt; rename(“TranslateAccelerator”, “...
-
如何MSHTML命名空间解析HTML文件(MSHTML::IHTMLDocument2Ptr 提示错误)
1.创建Win32或MFC工程.2.在预编译或需要使用MSHTML命名空间的头文件中添加以下语句: #include #include #import 3.前置条件设置完成,现在可以开始使用MSHTML访问里面的智能指针了。例:MSHTML::IHTMLDocument2Ptr pHTMLDoc2;MSHTML::IHTMLDocument3Ptr pHTMLDoc3;……然后解析自己需要的HTML元素。
-
怎么查看一个页面有多少链接
怎么查看一个页面有多少链接? 用google或360浏览器打开网站,按F12打开控制台工具,切换到console选项卡,如下图输入如下代码 标题 for(i=0;i<=$("a").length;i++){console.log($("a")[i].href)} 按回车键,控制台会显示出这个页面的所有链接。 本人亲测有效。 ...
-
C++ 使用MSHTML分析html
C++ 使用MSHTML分析html ,对MSHTML分析html简单介绍
-
在页面上查找所有链接
这是蜘蛛背后的基本原理。 $html = file_get_contents('http://www.example.com'); $dom = new DOMDocument(); @$dom->loadHTML($html); // grab all the on the page $xpath = new DOMXPath($dom); $hrefs = $xpath->...
-
request获得当前浏览器访问全部URL
String url= requestMap.getRequest().getHeader("referer");
-
模拟人工搜索,自动查找打开网站
这一次的案例是利用软件模拟人工,搜索关键词。然后在搜索结果中去查找指定的网站,并点击打开网站。首先打开百度搜索“怎么把文章发表到文库”,然后我们寻找百度文科的网站进入链接。 发现目标链接在搜索结果的第三页。那现在就好操作了。 首先打开网页自动操作通用工具PageOperator, 新建自动刷新操作窗口,点击添加添加百度网站。 ...
-
网页链接搜索王(webscanking) v2.1 bt
Welcome to my blog!网页链接搜索王(webscanking) v2.1 软件大小:283 KB软件语言:简体中文软件类别:国产软件 / 共享版 / 网络编程应用平台:Win9x/NT/2000/XP/2003界面预览:无插件情况: 投诉更新时间:2007-05-12 14:13:49下载次数:1409推荐等级:联 系 人:www.8715
-
.NET中获取HTML页面并提取其中的超链接
下列的函数分别用于获取HTML页面和提取页面中的超链接。using System.Net;using System.IO;using System.Text;using System.Text.RegularExpressions;string[] GetLink(string strHtml){ Regex reg = new Regex("href[//s//r]*=[//s//
-
浏览器打开url,查看返回的信息
在浏览器中,有时候需要查看,url请求的一些信息,现在在这里记录一下1.url在浏览器打开之后 ,右击选择 检查 ,然后刷新一下浏览器,产生数据2.产生数据后,找到Network 大类下,按下面路径查看数据信息, All ---&gt; 先左边(没数据的话可以F5刷新)---&gt; Header 部分信息这个是一些你请求时传递的数据:...
-
简易的Web自动化链接测试(Xenu)
1、理解链接需要测试的测试点: 【1】 要测试的链接页面是否存在 【2】 确定存在链接页面,然后就考虑跳转后的页面是不是对应需求的页面【3】 保证Web系统上没有孤立的页面(没有链接指向该页面) 2、需要用到的自动化工具Xenu Xenu有一定的局限性:只能测试链接存不存在,无法验证链接的正确性(意思是说只要能够跳转,即...
6 楼 gstarwd 2010-02-13 10:53
你跟本不懂构架 在这装*
5 楼 angin 2009-11-16 11:32
4 楼 condeywadl 2009-11-16 09:19
3 楼 whaosoft 2009-11-15 22:17
2 楼 berlou 2009-11-15 12:23
1 楼 打倒小日本 2009-11-15 00:28