asp 使用正則表達(dá)式替換word中的標(biāo)簽,轉(zhuǎn)為純文本
更新時(shí)間:2010年04月28日 22:35:48 作者:
asp里使用正則表達(dá)式清除后臺(tái)編輯器里復(fù)制粘貼內(nèi)容的word格式,將其轉(zhuǎn)換成純文本
公司客戶在使用網(wǎng)站后臺(tái)編輯添加修改內(nèi)容時(shí),經(jīng)常是直接從word文檔里復(fù)制內(nèi)容到編輯器里后就提交。結(jié)果是在內(nèi)容顯示頁(yè)面上是五花八門的樣式,有時(shí)也需要部分純文本內(nèi)容作為摘錄使用,這些都需要清除word格式。改變客戶的習(xí)慣要客戶先復(fù)制到記事本里再粘貼到編輯器里編輯是很難的,所以從我們自己改變起。從網(wǎng)上百度了若干清除word格式的正則,使用效果不甚理想,所以自己寫了清除word格式的asp函數(shù),能滿足我們自己的使用需求。函數(shù)如下:
function cleanWord(html)
dim regEx
set regEx=New RegExp
regEx.IgnoreCase=True
regEx.Global=True
regEx.Pattern="<[^>]*>" '清除所有<>之間的內(nèi)容
html = regEx.replace(html,"" )
regEx.Pattern="{[^}]*}" '清除所有{}之間的內(nèi)容
html = regEx.replace(html,"" )
regEx.Pattern="/[^/]*/" '清除所有/**/之間的注釋
html = regEx.replace(html,"" )
html =Replace(html,"table.MsoNormalTable","") '替換掉漏網(wǎng)的單詞
cleanWord= html
set regEx=nothing
end function
復(fù)制代碼 代碼如下:
function cleanWord(html)
dim regEx
set regEx=New RegExp
regEx.IgnoreCase=True
regEx.Global=True
regEx.Pattern="<[^>]*>" '清除所有<>之間的內(nèi)容
html = regEx.replace(html,"" )
regEx.Pattern="{[^}]*}" '清除所有{}之間的內(nèi)容
html = regEx.replace(html,"" )
regEx.Pattern="/[^/]*/" '清除所有/**/之間的注釋
html = regEx.replace(html,"" )
html =Replace(html,"table.MsoNormalTable","") '替換掉漏網(wǎng)的單詞
cleanWord= html
set regEx=nothing
end function
相關(guān)文章
asp下tag的實(shí)現(xiàn),簡(jiǎn)單介紹與部分代碼
asp下tag的實(shí)現(xiàn),簡(jiǎn)單介紹與部分代碼...2007-03-03
asp怎么獲取毫秒數(shù)實(shí)現(xiàn)代碼
得到17位的當(dāng)前時(shí)間如:20091210105237238=2009年12月10日10:52:37:238,接下來(lái)在獲取毫秒數(shù),感興趣的朋友可以參考下哈,希望可以幫助到你2013-04-04
實(shí)例分析之用ASP編程實(shí)現(xiàn)網(wǎng)絡(luò)內(nèi)容快速查找的代碼
實(shí)例分析之用ASP編程實(shí)現(xiàn)網(wǎng)絡(luò)內(nèi)容快速查找的代碼...2007-03-03
asp下讓數(shù)據(jù)庫(kù)在需要讀取的時(shí)候才打開
ASP實(shí)現(xiàn)讓數(shù)據(jù)庫(kù)連接僅在需要讀取數(shù)據(jù)庫(kù)時(shí)打開,我們有沒有辦法讓數(shù)據(jù)庫(kù)連接僅在需要讀取數(shù)據(jù)庫(kù)時(shí)才打開,不讀取時(shí)就沒有任何動(dòng)作呢,以下即提供這種思路,以求拋磚引玉。2008-06-06
asp下sql和access數(shù)據(jù)庫(kù)隨機(jī)取10條記錄的代碼newid()
利于搜索從表中隨機(jī)取幾條不重復(fù)記錄,一般都是10條,我就用了40條,大約的代碼就是下面的了2007-12-12

