防止文章被抄襲的網(wǎng)絡(luò)分析軟件

這是一個(gè)獨(dú)立的可執(zhí)行的程序,完全免費(fèi),基于ACCESS數(shù)據(jù)庫(kù),目前支持Z-Blog系統(tǒng),其實(shí)支持其他ASP的Blog修改也很簡(jiǎn)單,有需要的可以聯(lián)系一下我。(注:其他Blog程序的使用方法:先建立一個(gè)Access文件,然后建立一個(gè)表,表名為blog_Article,表中增加字段log_ID和log_Title,log_ID為自動(dòng)編號(hào),log_Title為文章標(biāo)題,然后將你Blog上的文章標(biāo)題都復(fù)制過(guò)來(lái),一篇文章對(duì)應(yīng)一條記錄,只復(fù)制標(biāo)題即可,然后在本程序中選擇這個(gè)數(shù)據(jù)庫(kù))
數(shù)據(jù)挖掘我是直接通過(guò)調(diào)用搜索引擎來(lái)實(shí)現(xiàn)的。原先打算使用Java下調(diào)用Google SOAP API來(lái)實(shí)現(xiàn),不過(guò)不知什么原因,Google SOAP API搜索英文沒(méi)有任何問(wèn)題,一搜索中文就報(bào)數(shù)組超界,不知道什么原因。只好去調(diào)用百度的搜索引擎。
百度的搜索引擎沒(méi)有API,不過(guò)我還是有辦法間接調(diào)用的。調(diào)用的時(shí)候發(fā)現(xiàn)中文的確沒(méi)有什么問(wèn)題,也沒(méi)有錯(cuò)誤,很順利就調(diào)通了程序。
我目前搜索的時(shí)候,采用了“實(shí)質(zhì)傷害”這個(gè)概念,因?yàn)槟壳拔恼罗D(zhuǎn)載的情況會(huì)非常多,每一個(gè)都去處理會(huì)很麻煩。因此我們只去尋找情況惡劣的即可。這個(gè)可以通過(guò)搜索引擎排名來(lái)實(shí)現(xiàn)。只尋找那些轉(zhuǎn)載地址對(duì)于原文影響最壞的。
這個(gè)程序使用起來(lái)很簡(jiǎn)單,先選擇數(shù)據(jù)庫(kù)文件,再選擇Z-Blog系統(tǒng),然后填寫你自己的域名,點(diǎn)搜索即可開始執(zhí)行。搜索完成后會(huì)自動(dòng)生成一個(gè)名為list.txt的文件,就是搜索結(jié)果。此程序?qū)τ诓糠謽?biāo)題的文章會(huì)有誤判,最好文章標(biāo)題個(gè)性化濃一些。軟件的界面看起來(lái)不是很好,因?yàn)槲覜](méi)有美工嘛。
點(diǎn)擊下載軟件:轉(zhuǎn)載文章搜索器
相關(guān)文章
破解電信檢測(cè),突破多用戶共享上網(wǎng)補(bǔ)丁包下載
2008-05-05
Windowns Diskpart下合并分區(qū)的方法dos下
非常不錯(cuò)的合并分區(qū)的方法,經(jīng)測(cè)試,好用,就是對(duì)于穩(wěn)定性就不知道了,理論下應(yīng)該沒(méi)什么問(wèn)題,對(duì)于個(gè)人電腦合并分區(qū)和服務(wù)器分區(qū)合并來(lái)說(shuō),無(wú)疑是一個(gè)非常好的辦法2008-08-08

