下載本文檔
版權(quán)說(shuō)明:本文檔由用戶提供并上傳,收益歸屬內(nèi)容提供方,若內(nèi)容存在侵權(quán),請(qǐng)進(jìn)行舉報(bào)或認(rèn)領(lǐng)
文檔簡(jiǎn)介
大數(shù)據(jù)流處理架構(gòu)工程師崗位招聘考試試卷及答案一、填空題(每題1分,共10分)1.ApacheFlink中負(fù)責(zé)調(diào)度任務(wù)和資源管理的核心組件是______。2.SparkStreaming的核心抽象是______,表示連續(xù)數(shù)據(jù)流的離散片段。3.Kafka中消息被組織在______中,每個(gè)該單元可分為多個(gè)分區(qū)。4.Flink中基于時(shí)間的無(wú)重疊固定窗口稱為______窗口。5.SparkStreaming屬于______處理,而非真正的流處理。6.ZooKeeper在Kafka集群中主要用于______選舉和狀態(tài)管理。7.Flink中存儲(chǔ)算子狀態(tài)的類型是______State。8.Kafka消費(fèi)者組內(nèi),每個(gè)消費(fèi)者負(fù)責(zé)一個(gè)或多個(gè)______的消息消費(fèi)。9.ApacheStorm中從外部讀取數(shù)據(jù)的組件是______。10.流處理中“至少被處理一次”的語(yǔ)義是______。答案:1.JobManager2.DStream3.Topic4.Tumbling(滾動(dòng))5.微批6.Controller(控制器)7.Operator8.Partition(分區(qū))9.Spout10.At-Least-Once二、單項(xiàng)選擇題(每題2分,共20分)1.以下支持真正流處理(非微批)的框架是?A.SparkStreamingB.FlinkC.StormD.KafkaStreams2.KafkaTopic創(chuàng)建后,分區(qū)數(shù)量可______。A.任意修改B.只增不減C.只減不增D.不可修改3.Flink中無(wú)重疊時(shí)間范圍的窗口是?A.TumblingB.SlidingC.SessionD.Count4.SparkStreaming默認(rèn)微批間隔是?A.100msB.500msC.1sD.5s5.不是Flink核心組件的是?A.JobManagerB.TaskManagerC.ZooKeeperD.StandaloneManager6.Kafka消費(fèi)者默認(rèn)偏移量提交方式是?A.自動(dòng)B.手動(dòng)同步C.手動(dòng)異步D.不提交7.Flink實(shí)現(xiàn)Exactly-Once的核心是?A.兩階段提交B.CheckpointC.水印D.狀態(tài)快照8.適合SessionWindow的場(chǎng)景是?A.每小時(shí)訂單量B.用戶會(huì)話內(nèi)操作數(shù)C.每分鐘PVD.固定消息數(shù)統(tǒng)計(jì)9.Storm每個(gè)Worker默認(rèn)啟動(dòng)多少Executor?A.1B.2C.4D.810.KafkaStreams的鍵值數(shù)據(jù)流抽象是?A.DStreamB.DataStreamC.KStreamD.Table答案:1.B2.B3.A4.C5.C6.A7.B8.B9.A10.C三、多項(xiàng)選擇題(每題2分,共20分)1.屬于流處理框架的是?A.FlinkB.SparkStreamingC.KafkaStreamsD.Elasticsearch2.Flink支持的狀態(tài)類型是?A.OperatorStateB.KeyedStateC.GlobalStateD.LocalState3.Exactly-Once語(yǔ)義依賴的技術(shù)是?A.消息可重放B.狀態(tài)快照與偏移量對(duì)齊C.兩階段提交D.消息無(wú)重復(fù)4.Kafka的主要作用是?A.消息隊(duì)列B.流存儲(chǔ)C.流處理D.搜索引擎5.Flink的部署模式包括?A.StandaloneB.YARNC.KubernetesD.Mesos6.SparkStreaming的缺點(diǎn)是?A.延遲較高B.無(wú)Exactly-Once支持C.狀態(tài)管理弱D.不支持事件時(shí)間7.Kafka生產(chǎn)者的配置項(xiàng)是?A.bootstrap.serversB.group.idC.acksD.auto.offset.reset8.Flink水印的作用是?A.處理亂序數(shù)據(jù)B.延遲數(shù)據(jù)C.窗口觸發(fā)D.狀態(tài)清理9.Storm拓?fù)涞慕M件是?A.SpoutB.BoltC.NimbusD.Supervisor10.流處理的應(yīng)用場(chǎng)景是?A.實(shí)時(shí)分析B.實(shí)時(shí)監(jiān)控C.實(shí)時(shí)推薦D.離線計(jì)算答案:1.ABC2.AB3.ABC4.AB5.ABCD6.AC7.AC8.ABC9.AB10.ABC四、判斷題(每題2分,共20分)1.SparkStreaming是真正的流處理框架。(×)2.Kafka分區(qū)只能被一個(gè)消費(fèi)者組的一個(gè)消費(fèi)者消費(fèi)。(√)3.FlinkCheckpoint默認(rèn)是增量快照。(×)4.ZooKeeper是Flink必備組件。(×)5.KafkaStreams無(wú)需額外部署。(√)6.Storm拓?fù)涮峤缓蟛荒苄薷?。(×?.FlinkKeyedState只能在按Key分組的流上使用。(√)8.At-Most-Once語(yǔ)義可能丟失消息。(√)9.SparkStreamingDStream不可變。(√)10.KafkaTopic可動(dòng)態(tài)創(chuàng)建。(√)五、簡(jiǎn)答題(每題5分,共20分)1.簡(jiǎn)述Flink與SparkStreaming的核心區(qū)別。答案:Flink是事件驅(qū)動(dòng)的真正流處理,延遲毫秒級(jí);SparkStreaming是微批處理,默認(rèn)1秒批次,延遲較高。Flink天然支持Exactly-Once(Checkpoint),SparkStreaming需額外配置。Flink狀態(tài)管理更強(qiáng)大(Operator/KeyedState、增量快照),SparkStreaming狀態(tài)管理較弱。Flink支持事件/處理/攝入時(shí)間,SparkStreaming早期僅支持處理時(shí)間。2.什么是流處理窗口?常見類型有哪些?答案:窗口是將無(wú)界數(shù)據(jù)流分段計(jì)算的機(jī)制。常見類型:①滾動(dòng)窗口(固定長(zhǎng)度、無(wú)重疊);②滑動(dòng)窗口(固定長(zhǎng)度、有重疊);③會(huì)話窗口(基于用戶活躍會(huì)話,無(wú)固定長(zhǎng)度);④計(jì)數(shù)窗口(按消息數(shù)量分段)。3.簡(jiǎn)述Kafka的工作原理。答案:Kafka以Topic為核心,Topic分多個(gè)Partition。生產(chǎn)者向Topic發(fā)消息,按序存于Partition;消費(fèi)者從Partition拉取,消費(fèi)者組內(nèi)每個(gè)消費(fèi)者負(fù)責(zé)一個(gè)或多個(gè)Partition,保證分區(qū)內(nèi)順序。ZooKeeper用于Controller選舉和集群狀態(tài)管理,消息持久化到日志。4.Exactly-Once語(yǔ)義依賴哪些技術(shù)?答案:①消息源可重放(如Kafka偏移量);②狀態(tài)快照(Checkpoint,記錄偏移量和狀態(tài));③兩階段提交(協(xié)調(diào)消息和狀態(tài)一致性);④冪等操作(避免重復(fù)處理結(jié)果不一致)。六、討論題(每題5分,共10分)1.設(shè)計(jì)高吞吐量低延遲訂單系統(tǒng),如何選擇流處理框架?答案:優(yōu)先選Flink。理由:①低延遲(事件驅(qū)動(dòng),毫秒級(jí))滿足實(shí)時(shí)訂單需求;②Exactly-Once保證訂單不重復(fù)丟失,避免賬務(wù)錯(cuò)誤;③強(qiáng)大狀態(tài)管理支持用戶訂單狀態(tài)存儲(chǔ);④靈活窗口(滾動(dòng)窗口統(tǒng)計(jì)實(shí)時(shí)訂單量、會(huì)話窗口分析用戶下單行為)。若初期規(guī)模小,可考慮KafkaStreams(輕量集成Kafka),但Flink擴(kuò)展性更強(qiáng)
溫馨提示
- 1. 本站所有資源如無(wú)特殊說(shuō)明,都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請(qǐng)下載最新的WinRAR軟件解壓。
- 2. 本站的文檔不包含任何第三方提供的附件圖紙等,如果需要附件,請(qǐng)聯(lián)系上傳者。文件的所有權(quán)益歸上傳用戶所有。
- 3. 本站RAR壓縮包中若帶圖紙,網(wǎng)頁(yè)內(nèi)容里面會(huì)有圖紙預(yù)覽,若沒(méi)有圖紙預(yù)覽就沒(méi)有圖紙。
- 4. 未經(jīng)權(quán)益所有人同意不得將文件中的內(nèi)容挪作商業(yè)或盈利用途。
- 5. 人人文庫(kù)網(wǎng)僅提供信息存儲(chǔ)空間,僅對(duì)用戶上傳內(nèi)容的表現(xiàn)方式做保護(hù)處理,對(duì)用戶上傳分享的文檔內(nèi)容本身不做任何修改或編輯,并不能對(duì)任何下載內(nèi)容負(fù)責(zé)。
- 6. 下載文件中如有侵權(quán)或不適當(dāng)內(nèi)容,請(qǐng)與我們聯(lián)系,我們立即糾正。
- 7. 本站不保證下載資源的準(zhǔn)確性、安全性和完整性, 同時(shí)也不承擔(dān)用戶因使用這些下載資源對(duì)自己和他人造成任何形式的傷害或損失。
最新文檔
- 2026年杭州市上城區(qū)望江街道社區(qū)衛(wèi)生服務(wù)中心編外招聘?jìng)淇碱}庫(kù)及答案詳解1套
- 囊謙縣人民醫(yī)院2025年面向社會(huì)公開招聘編外聘用工作人員的招聘?jìng)淇碱}庫(kù)及參考答案詳解一套
- 2026年泰州職業(yè)技術(shù)學(xué)院“銀發(fā)教師”長(zhǎng)期招募備考題庫(kù)及答案詳解1套
- 2026年鹽城經(jīng)濟(jì)技術(shù)開發(fā)區(qū)公開招聘基層醫(yī)療機(jī)構(gòu)專業(yè)技術(shù)人員6人備考題庫(kù)及答案詳解參考
- 2026年昭通市第三人民醫(yī)院總務(wù)科綜合崗位招聘?jìng)淇碱}庫(kù)及一套答案詳解
- 保密及知識(shí)產(chǎn)權(quán)保護(hù)制度
- 2026年重慶市北碚區(qū)東陽(yáng)街道辦事處非在編人員招聘?jìng)淇碱}庫(kù)及完整答案詳解1套
- 2026年茅嶺鎮(zhèn)衛(wèi)生院招聘?jìng)淇碱}庫(kù)含答案詳解
- 2026年順德區(qū)杏壇鎮(zhèn)林文恩中學(xué)招聘化學(xué)、英語(yǔ)臨聘教師備考題庫(kù)有答案詳解
- 中學(xué)校園安全應(yīng)急處理制度
- 黑龍江省哈爾濱市師范大學(xué)附中2026屆數(shù)學(xué)高三第一學(xué)期期末質(zhì)量檢測(cè)模擬試題含解析
- DB31T+1661-2025公共區(qū)域電子屏播控安全管理要求
- 醫(yī)療聯(lián)合體兒童保健服務(wù)模式創(chuàng)新
- 2025版中國(guó)胃癌保功能手術(shù)外科專家共識(shí)課件
- 中國(guó)高尿酸血癥與痛風(fēng)診療指南(2024更新版)課件
- TGXAS-火龍果品質(zhì)評(píng)價(jià)技術(shù)規(guī)范編制說(shuō)明
- (2025)70周歲以上老年人換長(zhǎng)久駕照三力測(cè)試題庫(kù)(含答案)3
- 口腔科門診主任年度工作匯報(bào)
- 2025至2030中國(guó)專用車行業(yè)發(fā)展分析及投資前景與戰(zhàn)略規(guī)劃報(bào)告
- DB13∕T 6066.3-2025 國(guó)資數(shù)智化 第3部分:數(shù)據(jù)治理規(guī)范
- 福建省能源石化集團(tuán)有限責(zé)任公司2025年秋季招聘?jìng)淇碱}庫(kù)及一套完整答案詳解
評(píng)論
0/150
提交評(píng)論