九九热最新网址,777奇米四色米奇影院在线播放,国产精品18久久久久久久久久,中文有码视频,亚洲一区在线免费观看,国产91精品在线,婷婷丁香六月天

歡迎來(lái)到裝配圖網(wǎng)! | 幫助中心 裝配圖網(wǎng)zhuangpeitu.com!
裝配圖網(wǎng)
ImageVerifierCode 換一換
首頁(yè) 裝配圖網(wǎng) > 資源分類 > DOC文檔下載  

數(shù)據(jù)倉(cāng)庫(kù)與數(shù)據(jù)挖掘考試試題.doc

  • 資源ID:6622227       資源大?。?span id="24d9guoke414" class="font-tahoma">108KB        全文頁(yè)數(shù):4頁(yè)
  • 資源格式: DOC        下載積分:9.9積分
快捷下載 游客一鍵下載
會(huì)員登錄下載
微信登錄下載
三方登錄下載: 微信開放平臺(tái)登錄 支付寶登錄   QQ登錄   微博登錄  
二維碼
微信掃一掃登錄
下載資源需要9.9積分
郵箱/手機(jī):
溫馨提示:
用戶名和密碼都是您填寫的郵箱或者手機(jī)號(hào),方便查詢和重復(fù)下載(系統(tǒng)自動(dòng)生成)
支付方式: 支付寶    微信支付   
驗(yàn)證碼:   換一換

 
賬號(hào):
密碼:
驗(yàn)證碼:   換一換
  忘記密碼?
    
友情提示
2、PDF文件下載后,可能會(huì)被瀏覽器默認(rèn)打開,此種情況可以點(diǎn)擊瀏覽器菜單,保存網(wǎng)頁(yè)到桌面,就可以正常下載了。
3、本站不支持迅雷下載,請(qǐng)使用電腦自帶的IE瀏覽器,或者360瀏覽器、谷歌瀏覽器下載即可。
4、本站資源下載后的文檔和圖紙-無(wú)水印,預(yù)覽文檔經(jīng)過(guò)壓縮,下載后原文更清晰。
5、試題試卷類文檔,如果標(biāo)題沒有明確說(shuō)明有答案則都視為沒有答案,請(qǐng)知曉。

數(shù)據(jù)倉(cāng)庫(kù)與數(shù)據(jù)挖掘考試試題.doc

一、 填空題(15分)1.數(shù)據(jù)倉(cāng)庫(kù)的特點(diǎn)分別是 面向主題 、 集成 、 相對(duì)穩(wěn)定 、反映歷史變化。2.元數(shù)據(jù)是描述數(shù)據(jù)倉(cāng)庫(kù)內(nèi)數(shù)據(jù)的結(jié)構(gòu)和建立方法的數(shù)據(jù)。根據(jù)元數(shù)據(jù)用途的不同可將元數(shù)據(jù)分為 技術(shù) 元數(shù)據(jù)和 業(yè)務(wù) 元數(shù)據(jù)兩類。3.OLAP技術(shù)多維分析過(guò)程中,多維分析操作包括 切片 、 切塊 、 鉆取 、 旋轉(zhuǎn) 等。4.基于依賴型數(shù)據(jù)集市和操作型數(shù)據(jù)存儲(chǔ)的數(shù)據(jù)倉(cāng)庫(kù)體系結(jié)構(gòu)常常被稱為“ 中心和輻射 ”架構(gòu),其中 企業(yè)級(jí)數(shù)據(jù)倉(cāng)庫(kù) 是中心,源數(shù)據(jù)系統(tǒng)和數(shù)據(jù)集市在輸入和輸出范圍的兩端。5.ODS實(shí)際上是一個(gè)集成的、 面向主題的 、 可更新的 、 當(dāng)前值的 、 企業(yè)級(jí)的 、詳細(xì)的數(shù)據(jù)庫(kù),也叫運(yùn)營(yíng)數(shù)據(jù)存儲(chǔ)。二、 多項(xiàng)選擇題(10分)6.在數(shù)據(jù)挖掘的分析方法中,直接數(shù)據(jù)挖掘包括( )A 分類 B 關(guān)聯(lián) C 估值 D 預(yù)言7.數(shù)據(jù)倉(cāng)庫(kù)的數(shù)據(jù)ETL過(guò)程中,ETL軟件的主要功能包括()A 數(shù)據(jù)抽取 B 數(shù)據(jù)轉(zhuǎn)換 C 數(shù)據(jù)加載 D 數(shù)據(jù)稽核8.數(shù)據(jù)分類的評(píng)價(jià)準(zhǔn)則包括( ABCD )A 精確度 B 查全率和查準(zhǔn)率 C F-Measure D 幾何均值9.層次聚類方法包括( BC )A 劃分聚類方法 B 凝聚型層次聚類方法 C 分解型層次聚類方法 D 基于密度聚類方法10.貝葉斯網(wǎng)絡(luò)由兩部分組成,分別是( A D )A 網(wǎng)絡(luò)結(jié)構(gòu) B 先驗(yàn)概率 C 后驗(yàn)概率 D 條件概率表三、 計(jì)算題(30分)11.一個(gè)食品連鎖店每周的事務(wù)記錄如下表所示,其中每一條事務(wù)表示在一項(xiàng)收款機(jī)業(yè)務(wù)中賣出的項(xiàng)目,假定supmin=40%,confmin=40%,使用Apriori算法計(jì)算生成的關(guān)聯(lián)規(guī)則,標(biāo)明每趟數(shù)據(jù)庫(kù)掃描時(shí)的候選集和大項(xiàng)目集。(15分)事務(wù)項(xiàng)目事務(wù)項(xiàng)目 T1 T2 T3面包、果凍、花生醬面包、花生醬面包、牛奶、花生醬 T4 T5啤酒、面包啤酒、牛奶解:(1)由I=面包、果凍、花生醬、牛奶、啤酒的所有項(xiàng)目直接產(chǎn)生1-候選C1,計(jì)算其支持度,取出支持度小于supmin的項(xiàng)集,形成1-頻繁集L1,如下表所示:項(xiàng)集C1 支持度 項(xiàng)集L1 支持度面包 花生醬 牛奶 啤酒 4/53/52/52/5面包 花生醬 牛奶 啤酒 4/5 3/5 2/5 2/5(2)組合連接L1中的各項(xiàng)目,產(chǎn)生2-候選集C2,計(jì)算其支持度,取出支持度小于supmin的項(xiàng)集,形成2-頻繁集L2,如下表所示:項(xiàng)集C2 支持度 項(xiàng)集L2支持度面包、花生醬 3/5面包、花生醬 3/5至此,所有頻繁集都被找到,算法結(jié)束,所以,confidence(面包花生醬)=(4/5)/(3/5)=4/3> confmin confidence( 花生醬面包)=(3/5)/(4/5)=3/4> confmin所以,關(guān)聯(lián)規(guī)則面包花生醬、 花生醬面包均是強(qiáng)關(guān)聯(lián)規(guī)則。12.給定以下數(shù)據(jù)集(2,4,10,12,15,3,21),進(jìn)行K-Means聚類,設(shè)定聚類數(shù)為2個(gè),相似度按照歐式距離計(jì)算。(15分)解:(1)從數(shù)據(jù)集X中隨機(jī)地選擇k個(gè)數(shù)據(jù)樣本作為聚類的出示代表點(diǎn),每一個(gè)代表點(diǎn)表示一個(gè)類別,由題可知k=2,則可設(shè)m1=2,m2=4:(2)對(duì)于X中的任意數(shù)據(jù)樣本xm(1<xm<total),計(jì)算它與k個(gè)初始代表點(diǎn)的距離,并且將它劃分到距離最近的初始代表點(diǎn)所表示的類別中:當(dāng)m1=2時(shí),樣本(2 ,4,10,12,15,3,21)距離該代表點(diǎn)的距離分別為2,8,10,13,1,19。當(dāng)m2=4時(shí),樣本(2 ,4,10,12,15,3,21)距離該代表點(diǎn)的距離分別為-2,6,8,11,-1,17。最小距離是1或者-1將該元素放入m1=2的聚類中,則該聚類為(2,3),另一個(gè)聚類m2=4為(4,10,12,15,21)。(3)完成數(shù)據(jù)樣本的劃分之后,對(duì)于每一個(gè)聚類,計(jì)算其中所有數(shù)據(jù)樣本的均值,并且將其作為該聚類的新的代表點(diǎn),由此得到k個(gè)均值代表點(diǎn):m1=2.5,m2=12:(4)對(duì)于X中的任意數(shù)據(jù)樣本xm(1<xm<total),計(jì)算它與k個(gè)初始代表點(diǎn)的距離,并且將它劃分到距離最近的初始代表點(diǎn)所表示的類別中:當(dāng)m1=2.5時(shí),樣本(2 ,4,10,12,15,3,21)距離該代表點(diǎn)的距離分別為-0.5,0.5,1.5,7.5,9.5,12.5,18.5。當(dāng)m2=12時(shí),樣本(2 ,4,10,12,15,3,21)距離該代表點(diǎn)的距離分別為-10,-9,-8,2,3,9。最小距離是1.5將該元素放入m1=2.5的聚類中,則該聚類為(2,3,4),另一個(gè)聚類m2=12為(10,12,15,21)。(5)完成數(shù)據(jù)樣本的劃分之后,對(duì)于每一個(gè)聚類,計(jì)算其中所有數(shù)據(jù)樣本的均值,并且將其作為該聚類的新的代表點(diǎn),由此得到k個(gè)均值代表點(diǎn):m1=3, m2=14.5:(6)對(duì)于X中的任意數(shù)據(jù)樣本xm(1<xm<total),計(jì)算它與k個(gè)初始代表點(diǎn)的距離,并且將它劃分到距離最近的初始代表點(diǎn)所表示的類別中:當(dāng)m1=3時(shí),樣本(2 ,4,10,12,15,3,21)距離該代表點(diǎn)的距離分別為-1,1,7,9,12,18,。當(dāng)m2=14.5時(shí),樣本(2 ,4,10,12,15,3,21)距離該代表點(diǎn)的距離分別為-12.58,-11.5,-10.5,-4.5,-2.5,0.5,6.5。最小距離是0.5將該元素放入m1=3的聚類中,則該聚類為(2,3,4),另一個(gè)聚類m2=14.5為(10,12,15,21)。至此,各個(gè)聚類不再發(fā)生變化為止,即誤差平方和準(zhǔn)則函數(shù)的值達(dá)到最優(yōu)。四設(shè)計(jì)題(45分)13.按照題目給定的3個(gè)數(shù)據(jù)文件,任選一個(gè)建立數(shù)據(jù)流圖,要求至少包括記錄選項(xiàng)、字段選項(xiàng)、圖形結(jié)點(diǎn)各一個(gè)。任選關(guān)聯(lián)規(guī)則Apriori算法、貝葉斯網(wǎng)絡(luò)、K-Means聚類、決策樹C5.0(C4.5)算法、神經(jīng)網(wǎng)絡(luò)中的一個(gè)進(jìn)行挖掘,并給出數(shù)據(jù)流圖。(10分)14.對(duì)以上數(shù)據(jù)流圖中使用的每個(gè)結(jié)點(diǎn)做一簡(jiǎn)短說(shuō)明。(10分)選擇:age>25.過(guò)濾:過(guò)濾后的字段。Region,tenure,age,marital,churn.類型:15.給出以上數(shù)據(jù)流圖中模型的執(zhí)行結(jié)果(生成模型完全展開后的數(shù)據(jù)),對(duì)于執(zhí)行結(jié)果太多的,可節(jié)選部分結(jié)果。(10分)16.對(duì)以上模型生成的結(jié)果做一簡(jiǎn)要的分析,包括算法采用的基本原理、數(shù)學(xué)模型、算法步驟等。(15分)答:k-means聚類算法基本原理:將各個(gè)聚類子集內(nèi)的所有數(shù)據(jù)樣本的均值作為該聚類的代表點(diǎn),算法的主要思想是通過(guò)迭代過(guò)程把數(shù)據(jù)劃分為不同的類別,使得評(píng)價(jià)聚集類性能的準(zhǔn)則函數(shù)達(dá)到最優(yōu),從而使生成的每個(gè)聚集類的緊湊,類間獨(dú)立。操作步驟:輸入:數(shù)據(jù)集,其中的數(shù)據(jù)樣本只包含描述屬性,不包含類別屬性。聚類個(gè)數(shù)K輸出:(1)從數(shù)據(jù)集X中隨機(jī)地選擇k個(gè)數(shù)據(jù)樣本作為聚類的出示代表點(diǎn),每一個(gè)代表點(diǎn)表示一個(gè)類別(2)對(duì)于X中的任意數(shù)據(jù)樣本xm(1<xm<total),計(jì)算它與k個(gè)初始代表點(diǎn)的距離,并且將它劃分到距離最近的初始代表點(diǎn)所表示的類別中(3)完成數(shù)據(jù)樣本的劃分之后,對(duì)于每一個(gè)聚類,計(jì)算其中所有數(shù)據(jù)樣本的均值,并且將其作為該聚類的新的代表點(diǎn),由此得到k個(gè)均值代表點(diǎn)(4)對(duì)于X中的任意數(shù)據(jù)樣本xm(1<xm<total),計(jì)算它與k個(gè)初始代表點(diǎn)的距離,并且將它劃分到距離最近的初始代表點(diǎn)所表示的類別中(5)重復(fù)3.4,直到各個(gè)聚類不再發(fā)生變化為止。即誤差平方和準(zhǔn)則函數(shù)的值達(dá)到最優(yōu)

注意事項(xiàng)

本文(數(shù)據(jù)倉(cāng)庫(kù)與數(shù)據(jù)挖掘考試試題.doc)為本站會(huì)員(xin****828)主動(dòng)上傳,裝配圖網(wǎng)僅提供信息存儲(chǔ)空間,僅對(duì)用戶上傳內(nèi)容的表現(xiàn)方式做保護(hù)處理,對(duì)上載內(nèi)容本身不做任何修改或編輯。 若此文所含內(nèi)容侵犯了您的版權(quán)或隱私,請(qǐng)立即通知裝配圖網(wǎng)(點(diǎn)擊聯(lián)系客服),我們立即給予刪除!

溫馨提示:如果因?yàn)榫W(wǎng)速或其他原因下載失敗請(qǐng)重新下載,重復(fù)下載不扣分。




關(guān)于我們 - 網(wǎng)站聲明 - 網(wǎng)站地圖 - 資源地圖 - 友情鏈接 - 網(wǎng)站客服 - 聯(lián)系我們

copyright@ 2023-2025  zhuangpeitu.com 裝配圖網(wǎng)版權(quán)所有   聯(lián)系電話:18123376007

備案號(hào):ICP2024067431號(hào)-1 川公網(wǎng)安備51140202000466號(hào)


本站為文檔C2C交易模式,即用戶上傳的文檔直接被用戶下載,本站只是中間服務(wù)平臺(tái),本站所有文檔下載所得的收益歸上傳人(含作者)所有。裝配圖網(wǎng)僅提供信息存儲(chǔ)空間,僅對(duì)用戶上傳內(nèi)容的表現(xiàn)方式做保護(hù)處理,對(duì)上載內(nèi)容本身不做任何修改或編輯。若文檔所含內(nèi)容侵犯了您的版權(quán)或隱私,請(qǐng)立即通知裝配圖網(wǎng),我們立即給予刪除!