色噜噜人体337p人体 I 超碰97观看 I 91久久香蕉国产日韩欧美9色 I 色婷婷我要去我去也 I 日本午夜a I 国产av高清怡春院 I 桃色精品 I 91香蕉国产 I 另类小说第一页 I 日操夜夜操 I 久久性色 I 日韩欧在线 I 国产深夜在线观看 I 免费的av I 18在线观看视频 I 他也色在线视频 I 亚洲熟女中文字幕男人总站 I 亚洲国产综合精品中文第一 I 人妻丰满熟av无码区hd I 新黄色网址 I 国产精品真实灌醉女在线播放 I 欧美巨大荫蒂茸毛毛人妖 I 国产一区欧美 I 欧洲亚洲1卡二卡三卡2021 I 国产亚洲欧美在线观看三区 I 97精品无人区乱码在线观看 I 欧美妇人 I 96精品在线视频 I 国产人免费视频在线观看 I 91麻豆国产福利在线观看

Frame頁(yè)面網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理方法的論文

時(shí)間:2021-06-11 09:11:33 論文 我要投稿

關(guān)于Frame頁(yè)面網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理方法的論文

  摘 要

關(guān)于Frame頁(yè)面網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理方法的論文

  本文結(jié)合網(wǎng)絡(luò)日志數(shù)據(jù)挖掘技術(shù),通過(guò)對(duì)Frame頁(yè)面和SubFrame頁(yè)面進(jìn)行分析,提出基于改進(jìn)的Frame頁(yè)面數(shù)據(jù)挖掘預(yù)處理方法。該方法從SubFrame頁(yè)面信息著手,從而提高預(yù)處理過(guò)程中的信息識(shí)別能力。實(shí)驗(yàn)表明,該方法在網(wǎng)絡(luò)日志的數(shù)據(jù)挖掘預(yù)處理過(guò)程中,有效提高了信息的精準(zhǔn)度。

  【關(guān)鍵詞】數(shù)據(jù)挖掘 Frame頁(yè)面 SubFrame頁(yè)面

  1 引言

  隨著互聯(lián)網(wǎng)技術(shù)的迅猛發(fā)展,簡(jiǎn)單的信息搜索技術(shù)已經(jīng)不能滿(mǎn)足現(xiàn)階段網(wǎng)絡(luò)信息獲取的需求。網(wǎng)絡(luò)日志數(shù)據(jù)挖掘技術(shù)是結(jié)合網(wǎng)絡(luò)日志用戶(hù)的訪(fǎng)問(wèn)行為規(guī)律、興趣需求等信息,加以分析,優(yōu)化網(wǎng)絡(luò)內(nèi)容與網(wǎng)絡(luò)文本文檔的組織結(jié)構(gòu),以此提高網(wǎng)絡(luò)站點(diǎn)的競(jìng)爭(zhēng)力。我們發(fā)現(xiàn)網(wǎng)絡(luò)日志記錄往往十分龐大,傳統(tǒng)的預(yù)處理方法,并不能很好解決日志頁(yè)面對(duì)站點(diǎn)組織結(jié)構(gòu)的影響。因此,進(jìn)行網(wǎng)絡(luò)日志預(yù)處理方法的研究,具有一定的現(xiàn)實(shí)意義。

  對(duì)于傳統(tǒng)的網(wǎng)絡(luò)日志的數(shù)據(jù)挖掘,預(yù)處理階段的Frame頁(yè)面和SubFrame頁(yè)面在用戶(hù)會(huì)話(huà)文件出現(xiàn)的概率很高,這就降低了會(huì)話(huà)識(shí)別的興趣度。因此,必須消除Frame頁(yè)面對(duì)網(wǎng)絡(luò)日志數(shù)據(jù)挖掘的影響。我們將Frame頁(yè)面以及其SubFrame頁(yè)面被看為一個(gè)整體,用Frame頁(yè)面代替通過(guò)會(huì)話(huà)文件尋找Frame頁(yè)面和Subframe頁(yè)面,并剔除多余的頁(yè)面,以提高日志數(shù)據(jù)挖掘的興趣性。

  2 改進(jìn)的'Frame頁(yè)面數(shù)據(jù)挖掘預(yù)處理方法

  通過(guò)對(duì)Frame頁(yè)面過(guò)濾方法,結(jié)合實(shí)際情況分析,我們利用ID3決策樹(shù)算法,提出基于改進(jìn)的Frame頁(yè)面過(guò)濾方法,以提高網(wǎng)絡(luò)日志數(shù)據(jù)挖據(jù)的效率。該方法如下:

  輸入:FS表(pidframne , pidsubframe)所對(duì)應(yīng)的集合;集合屬性包括 {index.html,top.html,left.html,main.html,…}

  輸出:判定策略

  For each users session

  {

  currentframe=null

  make_node(web)

  if((cerrenframe, pid, ∈FS) make_tree(currentframe,web_left)

  Else if pid, ∈dom(FS)

  {curremtframe pidi make_decition_tree(currentframe,web_left}

  else make_decition-tree(currentframe,web_rleft

  if attribute_list=null{make_decition_tree(currentframe,web_right);}

  else if(one ofattribute_list)>allgain

  currentframe=test-attribute;

  make_decition(ai,web_left)

  Else generate_decision_tree(ai,web_right)

  }

  上述策略認(rèn)為,訪(fǎng)問(wèn)站點(diǎn)的頁(yè)面為根節(jié)點(diǎn),具有信息增益最高的特征,currentframe變量記錄web當(dāng)前頁(yè)面pidi。若當(dāng)前頁(yè)面pidi不屬于frame頁(yè)面,則歸類(lèi)左子樹(shù),反之當(dāng)前頁(yè)面pidi歸入右子樹(shù)。即pid,∈DOM(FS)。而frame頁(yè)面的subframe頁(yè)面歸類(lèi)左子樹(shù)。這樣一來(lái),frame頁(yè)面為決策樹(shù)右樹(shù),subframe頁(yè)面為決策樹(shù)左樹(shù),subframe頁(yè)面在會(huì)話(huà)識(shí)別階段得到保留,以便后續(xù)路徑補(bǔ)充。該方法優(yōu)化了站點(diǎn)的組織結(jié)構(gòu),較好提升了網(wǎng)絡(luò)日志數(shù)據(jù)預(yù)處理效率。

  3 實(shí)驗(yàn)分析

  我們通過(guò)Frame頁(yè)面過(guò)濾預(yù)處理方法實(shí)驗(yàn),驗(yàn)證本文提出的改進(jìn)方法。實(shí)驗(yàn)提取700個(gè)日志所記錄的訪(fǎng)問(wèn)頁(yè)面,共20萬(wàn)條日志文件,結(jié)合本文提出的改進(jìn)Frame頁(yè)面網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理方法,與傳統(tǒng)頁(yè)面預(yù)處理方法進(jìn)行對(duì)比測(cè)試。結(jié)果如表1所示。

  在表1中,絕對(duì)支持度表示用戶(hù)頻繁訪(fǎng)問(wèn)頁(yè)面的最小會(huì)話(huà)數(shù),F(xiàn)Si表示用戶(hù)頻繁訪(fǎng)問(wèn)頁(yè)面集合數(shù),*為用戶(hù)不感興趣的頁(yè)面集,△表示頁(yè)面集是用戶(hù)感興趣的,△△表示頁(yè)面集用戶(hù)感興趣程度加強(qiáng)。實(shí)驗(yàn)表明,改進(jìn)Frame頁(yè)面過(guò)濾方法相比傳統(tǒng)方法,預(yù)處理結(jié)果得到提高,因此,網(wǎng)絡(luò)日志的數(shù)據(jù)挖掘效率得到加強(qiáng)。

  4 小結(jié)

  本文通過(guò)對(duì)網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理技術(shù)進(jìn)行分析,結(jié)合預(yù)處理過(guò)程中的實(shí)際情況,著重考慮SubFrame頁(yè)面剔除對(duì)站點(diǎn)組織結(jié)構(gòu)的影響,提出了改進(jìn)的Frame頁(yè)面網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理方法,實(shí)驗(yàn)表明,該方法較好的提高了網(wǎng)絡(luò)日志數(shù)據(jù)挖掘的預(yù)處理精度和效率。

  參考文獻(xiàn)

  [1]方元康等.一種改進(jìn)的Web日志會(huì)話(huà)識(shí)別方法[J].計(jì)算機(jī)技術(shù)與發(fā)展,2008,18(11):214-216.

  [2]朱明.數(shù)據(jù)挖掘[M].合肥:中國(guó)科技大學(xué)出版社,2008:13-56.

  [3]朱志國(guó)等.持久偏愛(ài)的Web用戶(hù)訪(fǎng)問(wèn)路徑信息挖掘方法[J].情報(bào)學(xué)報(bào),2010,29(2).

  [4]凌海峰等.基于混合蟻群算法的web用戶(hù)會(huì)話(huà)聚類(lèi)[J].計(jì)算機(jī)工程與應(yīng)用,2013(22).

  [5]韓法旺.Web日志挖掘數(shù)據(jù)預(yù)處理過(guò)程研究[J].南京工業(yè)職業(yè)技術(shù)學(xué)院學(xué)報(bào),2012(2).

  [6]凌海峰等.基于聚類(lèi)的web用戶(hù)會(huì)話(huà)識(shí)別優(yōu)化方法[J].計(jì)算機(jī)應(yīng)用研究,2012(8).

【Frame頁(yè)面網(wǎng)絡(luò)日志數(shù)據(jù)挖掘預(yù)處理方法的論文】相關(guān)文章:

數(shù)據(jù)挖掘論文03-31

數(shù)據(jù)挖掘論文07-15

數(shù)據(jù)挖掘教學(xué)方法研究論文07-04

專(zhuān)利數(shù)據(jù)挖掘的論文06-12

數(shù)據(jù)挖掘論文精選5篇論文06-13

網(wǎng)絡(luò)數(shù)據(jù)挖掘規(guī)劃論文04-03

大數(shù)據(jù)自動(dòng)分析與數(shù)據(jù)挖掘探討的論文04-26

數(shù)據(jù)挖掘技術(shù)在WEB的運(yùn)用論文04-26

數(shù)據(jù)挖掘在CRM中的應(yīng)用論文04-10

主站蜘蛛池模板: 你懂的网站在线 | 亚洲国产精品成人综合色 | 久久久精品高清 | 午夜影院120秒 | 日韩精品无码一区二区视频 | 久久久美女视频 | 爱搞逼综合网 | 久久国产精品99精品国产987 | 波多野结衣欲乱 | 一本色道久久加勒比88综合 | 永久黄网站免费视频性色 | 欧美日韩久久久 | 九九在线视频免费观看精彩 | 日噜噜噜 | 91啪国产| 91视频区 | 亚洲人成网站在线播放大全 | 狠狠躁日日躁夜夜躁2020 | 久久精品视频在线观看免费 | 饭岛爱av片在线播放 | 国产精品午夜福利麻豆 | 影音先锋在线中文字幕 | 成人va在线观看 | 亚洲国产综合一区 | 国产一级女医生av毛片 | 热99re| 国产无遮挡在线观看 | 亚洲综合另类小说专区 | 国产精品国产三级国产aⅴ浪潮 | 91精品国产91久久久久青草 | 国产与黑人在线播放 | 中文资源在线观看 | 精久久| 亚洲碰碰人人av熟女天堂 | 99亚洲国产精品 | 国产永久在线 | 日本少妇肉体裸交xxx | va精品| 日日日网站 | 中文精品一区 | 激情欧美一区二区 | 国产农村妇女毛片精品久久 | 91拍拍| 日韩精品久久一区 | 99视频偷窥在线精品国自产拍 | 韩日av一区二区 | 在线中文字幕第一页 | 国产午夜精品一区二区三区极品 | 国产精品丝袜一区二区 | 丝袜足脚交91精品 | 草碰在线| 无色网 | 久久99精品国产麻豆婷婷洗澡 | 欧美岛国国产 | 国产91精品看黄网站在线观看动漫 | 伊人自拍| 免费无码又爽又刺激成人 | www中文字幕综合码 青青草福利视频 | 亚洲综合无码日韩国产加勒比 | 亚洲国产成人av片在线播放 | 五月婷香蕉久色在线看 | 亚洲图片欧美在线 | 亚洲高清免费观看 | 久久久久久久久网 | 日韩欧美视频二区 | 中文字幕视频播放 | 91精品国产色综合久久不卡98最新章节 | 夜夜做天天干 | 精品视频一区二区在线观看 | deos| 国产精品玩偶在线观看 | 精品中出 | 精品国产制服丝袜高跟 | 国产肥熟女视频一区二区三区 | 国产wwwxxx| 91在线免费播放 | 国产精品久久片 | 国产吃奶在线观看 | 国产日韩在线视看第一页 | 日本国产网曝视频在线观看 | 黄色在线播放 | 99热视| 蜜桃av一区二区三区www | 国内精品久久人妻无码不卡 | 色香蕉视频在线观看 | 欧美群妇大交乱免费视频 | 午夜成人免费视频 | 国精品无码人妻一区二区三区 | 91n成人| 色婷婷综合久色aⅴ五区最新 | 欧美黑吊大战白妞 | 久爱www成人网免费视频 | 99久久精品国产欧美主题曲 | 日日夜夜网站 | 国产成人啪精品视频免费网 | 高清亚洲 | 性虎精品无码av导航 | 久久久久玖玖 | 国内精品乱码卡一卡2卡麻豆 |