众所周知 有了数据库的验证地址和字符串那无异于拿到了通向数据库之门的钥匙 比一两个代理有价值多了 下面我就提供一种字符串的获取方法 希望对新手们有参考价值。 以karger数据库为例 :
第一步:首先寻找到用一般IP和文献IP登录时界面显示不同的网页 一般是数据库的登录界面 在KARGER中找到其地址为:
http://content.karger.com/Produk ... p;ContentOnly=false 当然如果你的目标是下载其中一本杂志的全文 亦可找到全文下载的页面 这都是根据你的目的不同去寻找不同的有差别网页
第二步 获得网页的源文件 : 源文件的获取可以点击IE上查看---源文件选项 将不使用代理时的网页源文件保存为“文件1” 将使用代理的网页源文件保存为“文件2“ (亦可采用以下方法: 在代理猎手参数设置验证地址项中选择 添加 将上述地址输入地址栏 选择文件匹配 点获取按钮 先不使用代理获取源文件 将其保存为“文件1” ; 之后在选择代理框前打钩 输入文献代理 再次获取源文件 将其保存为“文件2”
第三步 区分源文件1和2的差别 可运用于文档差别比较的专门软件不少 下面介绍一种比较简单的方法 即运用WORD的文件比较功能区分出使用代理和不使用代理的网页文件的差别 原则上所有差别的字符串都可以用作验证字符串 当然一般采用出现比较早的字符串以减少验证时间 在KARGER 验证中可以看到最早出现的差别是 阳性(使用代理):loginaccepted 阴性:loginstart 这比一般采用的We recognize you as (也出现在差别文件中) 略优 当然这儿的出现时间差别并不大 只是为了说明选择的原则
这是我在字符串寻找中采用的一种方法 感觉比较简单 运用的软件和所需知识不多 应该对刚入门的朋友比较合适 希望高手多多指正
这一方法运用的关键是找到使用代理和不使用代理具有差别的网页界面 当然你事先也需要一个文献代理作为阳性比较 不过对有些能使地址自动转向的数据库网址如SPRINGER上述方法是失效的 对于这些网址 我还无法用代理猎手来验证 只能用模拟IE验证一下 不过效果显然不太理想 希望有高手指教。