新聞中心
本篇內(nèi)容介紹了“MapReduce的類型與格式介紹”的有關(guān)知識(shí),在實(shí)際案例的操作過(guò)程中,不少人都會(huì)遇到這樣的困境,接下來(lái)就讓小編帶領(lǐng)大家學(xué)習(xí)一下如何處理這些情況吧!希望大家仔細(xì)閱讀,能夠?qū)W有所成!
創(chuàng)新互聯(lián)建站是一家專注網(wǎng)站建設(shè)、網(wǎng)絡(luò)營(yíng)銷策劃、小程序開(kāi)發(fā)、電子商務(wù)建設(shè)、網(wǎng)絡(luò)推廣、移動(dòng)互聯(lián)開(kāi)發(fā)、研究、服務(wù)為一體的技術(shù)型公司。公司成立十余年以來(lái),已經(jīng)為上1000+茶樓設(shè)計(jì)各業(yè)的企業(yè)公司提供互聯(lián)網(wǎng)服務(wù)。現(xiàn)在,服務(wù)的上1000+客戶與我們一路同行,見(jiàn)證我們的成長(zhǎng);未來(lái),我們一起分享成功的喜悅。
MapReduce 的類型
reduce函數(shù)的輸入類型必須與map函數(shù)的輸出類型匹配,但reduce函數(shù)的輸出類型可以不同于輸入類型
輸入格式
輸入分片與記錄
一個(gè)輸入分片就是一個(gè)由單個(gè)map操作來(lái)處理的輸入塊 InputSplit接口
文本輸入
TextInputFormat
控制一行最大的長(zhǎng)度
KeyValueTextInputFormat
NLineInputFormat
XML
二進(jìn)制輸入
SequenceFileInputFormat
SequenceFileAsTextInputFormat
SequenceFileAsBinaryInputFormat
FixedLengthInputFormat
多個(gè)輸入
MultipleInputs
數(shù)據(jù)庫(kù)輸入和輸出
DBInputFormat 這種輸入格式用于使用JDBC從關(guān)系型數(shù)據(jù)庫(kù)中讀取數(shù)據(jù)。因?yàn)樗鼪](méi)有任何共享能力,所以在訪問(wèn)數(shù)據(jù)庫(kù)的時(shí)候必須非常小心,在數(shù)據(jù)庫(kù)中運(yùn)行太多的mapper讀數(shù)據(jù)可能會(huì)使數(shù)據(jù)庫(kù)受不了。
另一種方法是Sqoop
輸出格式
OutputFormat
文本輸出
TextOutputFormat
鍵-值對(duì)由制表符進(jìn)行分隔,設(shè)定mapreduce.output.textoutputformat.separator屬性改變默認(rèn)的分隔符
對(duì)應(yīng)的輸入格式是KeyValueTextInputFormat
二進(jìn)制輸出
SequenceFileOutputFormat
SequenceFileAsBinaryOutputFormat
MapFileOutputFormat
多個(gè)輸出
MultipleOutputFormat
MultipleOutput 類可以將數(shù)據(jù)寫到多個(gè)文件
延遲輸出
LazyOutputFormat
FileOutputFormat 的子類會(huì)產(chǎn)生輸出文件(part-r-nnnnn),即使文件是空的。有些應(yīng)用傾向于不創(chuàng)建空文件數(shù)據(jù)庫(kù)輸出
“MapReduce的類型與格式介紹”的內(nèi)容就介紹到這里了,感謝大家的閱讀。如果想了解更多行業(yè)相關(guān)的知識(shí)可以關(guān)注創(chuàng)新互聯(lián)網(wǎng)站,小編將為大家輸出更多高質(zhì)量的實(shí)用文章!
文章標(biāo)題:MapReduce的類型與格式介紹
分享路徑:http://www.dlmjj.cn/article/jeisis.html