黄色视频网站国产_国产日韩欧美一区_A黄视频在线观看视频_真人无码作爱试看_玖玖资源站亚洲最大的网站_日韩无砖2021特黄_综合自拍制服欧美亚洲区_亚洲51自拍视频_欧美日韩国产一区二区国产_中文伦理片最新最好看

news center新聞中心
首頁>>新聞中心>>建站經(jīng)驗
分享新聞到:

網(wǎng)頁設(shè)計網(wǎng)頁的采集

啟奧科技:2021-05-22 04:16:00     閱讀數(shù):       標(biāo)簽:網(wǎng)頁設(shè)計網(wǎng)頁的采集
 在網(wǎng)頁設(shè)計中,網(wǎng)頁采集是什么,又是如何采集的呢?
 
深圳網(wǎng)站建設(shè)       網(wǎng)頁采集作為政府網(wǎng)站網(wǎng)頁在線歸檔的首要環(huán)節(jié),就是利用相關(guān)工具,以既定的頻率和方式,及時選擇值得保存的政府網(wǎng)頁內(nèi)容。網(wǎng)頁采集的第一步是要確定采集對象,政府網(wǎng)頁歸檔保存的信息采集對象是域名中含有“gov.cn”的政府網(wǎng)站,為確保政府網(wǎng)頁的采集質(zhì)量,需要對目標(biāo)網(wǎng)站進(jìn)行評價,將那些信息規(guī)模大、原生性信息多、更新頻繁的政府網(wǎng)站選定為采集對象。在確定要采集的目標(biāo)政府網(wǎng)站之后,還應(yīng)根據(jù)實際需求選擇相應(yīng)的采集方式。
       完整性采集和選擇性采集是目前比較常用的網(wǎng)絡(luò)資源采集方式,它們各有優(yōu)缺點,為了彌補(bǔ)其各自的不足,可以實現(xiàn)兩種采集方式的優(yōu)勢互補(bǔ),采用融合二者優(yōu)點的混合型采集方式,在對選定的政府網(wǎng)站中所有網(wǎng)頁進(jìn)行完整性采集的同時,通過人工干預(yù)的方式對網(wǎng)頁內(nèi)容進(jìn)行甄別,對其中有證據(jù)價值、歷史價值、研究價值的重要網(wǎng)頁,有選擇性地進(jìn)行深層次的頻繁采集,這樣既考慮到了政府網(wǎng)頁采集面的廣度,同時又照顧到了重要網(wǎng)頁采集的深度。
       而網(wǎng)頁的采集與捕獲最終還需要依靠相應(yīng)的網(wǎng)絡(luò)爬蟲工具來實現(xiàn),目前面向網(wǎng)頁存檔的爬蟲工具比較多,其中Heritrix、HTTrack最為常用,可利用這些工具來有針對性地完成對目標(biāo)政府網(wǎng)站網(wǎng)頁的自動批量在線采集。