久久精品国产亚洲高清|精品日韩中文乱码在线|亚洲va中文字幕无码久|伊人久久综合狼伊人久久|亚洲不卡av不卡一区二区|精品久久久久久久蜜臀AV|国产精品19久久久久久不卡|国产男女猛烈视频在线观看麻豆

    1. <style id="76ofp"></style>

      <style id="76ofp"></style>
      <rt id="76ofp"></rt>
      <form id="76ofp"><optgroup id="76ofp"></optgroup></form>
      1. 千鋒教育-做有情懷、有良心、有品質(zhì)的職業(yè)教育機(jī)構(gòu)

        手機(jī)站
        千鋒教育

        千鋒學(xué)習(xí)站 | 隨時(shí)隨地免費(fèi)學(xué)

        千鋒教育

        掃一掃進(jìn)入千鋒手機(jī)站

        領(lǐng)取全套視頻
        千鋒教育

        關(guān)注千鋒學(xué)習(xí)站小程序
        隨時(shí)隨地免費(fèi)學(xué)習(xí)課程

        當(dāng)前位置:首頁  >  應(yīng)聘面試  >  大數(shù)據(jù)面試題  > 必看!拿下這9個(gè)大數(shù)據(jù)面試題,輕松拿下offer

        必看!拿下這9個(gè)大數(shù)據(jù)面試題,輕松拿下offer

        來源:千鋒教育
        發(fā)布人:syq
        時(shí)間: 2022-08-09 14:33:14 1660026794

          1. “消費(fèi)組中的消費(fèi)者個(gè)數(shù)如果超過topic的分區(qū),那么就會(huì)有消費(fèi)者消費(fèi)不到數(shù)據(jù)”這句話是否正確?如果正確,那么有沒有什么hack的手段?

          答案:正確,可以通過自定義分區(qū)分配策略,將消費(fèi)者指定到某個(gè)分區(qū)

        大數(shù)據(jù)面試題

          2. 有哪些情形會(huì)造成重復(fù)消費(fèi)或消息丟失?

          答案:

          1)當(dāng)poll部分消息集后,立即提交offset,在這部分消息集處理,可能會(huì)發(fā)生異常,這就導(dǎo)致部分消息丟失。

          2)位移提交的動(dòng)作是在消費(fèi)完所有拉取到的消息之后才執(zhí)行的,中間可能發(fā)生異常,恢復(fù)后重新重新拉取,可能會(huì)導(dǎo)致重復(fù)消費(fèi)

          3. KafkaConsumer是非線程安全的,那么怎么樣實(shí)現(xiàn)多線程消費(fèi)?

          答案:

          1)在每個(gè)線程中新建一個(gè)KafkaConsumer

          2)單線程創(chuàng)建KafkaConsumer,多個(gè)處理線程處理消息(難點(diǎn)在于是否要考慮消息順序性,offset的提交方式)

          4. 當(dāng)你使用kafka-topics.sh創(chuàng)建(刪除)了一個(gè)topic

          答案:

          創(chuàng)建:

          1)會(huì)在zookeeper中的/brokers/topics節(jié)點(diǎn)下創(chuàng)建一個(gè)新的topic節(jié)點(diǎn),如:/brokers/topics/first

          2)觸發(fā)Controller的監(jiān)聽程序

          3)kafka Controller 負(fù)責(zé)topic的創(chuàng)建工作,并更新metadata cache

          刪除:

          調(diào)用腳本刪除topic會(huì)在zk上將topic設(shè)置待刪除標(biāo)志,kafka后臺(tái)有定時(shí)的線程會(huì)掃描所有需要?jiǎng)h除的topic進(jìn)行刪除

          5. topic的分區(qū)數(shù),增減問題

          答案:分區(qū)只能增加,不能減少(若是減少分區(qū)需要考慮的問題太多,事物性問題,順序性問題,時(shí)間戳問題,但是收益太小),副本可以減少

          6. 內(nèi)部topic

          _consumeroffsets:作用是保存 Kafka 消費(fèi)者的位移信息,logCleaner線程來完成清除無用的提交(沒有消息消費(fèi)了,默認(rèn)5s一直在提交);

          _transactionstate:用來存儲(chǔ)事務(wù)日志消息

          7. 優(yōu)先副本選舉

          答案:解決當(dāng)某個(gè)主機(jī)down機(jī)后,部分主機(jī)會(huì)有多個(gè)leader 副本,導(dǎo)致負(fù)載不均衡,優(yōu)先副本選舉就是解決此問題,生產(chǎn)上不建議開啟,可以手動(dòng)控制。

          8. 副本怎么同步?

          答案:所謂同步,必須滿足兩個(gè)條件:

          副本節(jié)點(diǎn)必須能與zookeeper保持會(huì)話(心跳機(jī)制)

          副本能復(fù)制leader上的所有寫操作,并且不能落后太多(卡主或滯后的副本控制由replica.lag.time.max.ms配置)

          利用HW,LEO進(jìn)行復(fù)制同步。

          9. 如果我指定了一個(gè)offset,Kafka怎么查找到對(duì)應(yīng)的消息?

          答案:

          1)跳躍表找到分段文件

          2)利用稀疏索引(.index),通過二分法定位到相鄰的offset

          3)接著在segment順序查找

          更多關(guān)于大數(shù)據(jù)培訓(xùn)的問題,歡迎咨詢千鋒教育在線名師,如果想要了解我們的師資、課程、項(xiàng)目實(shí)操的話可以點(diǎn)擊咨詢課程顧問,獲取試聽資格來試聽我們的課程,在線零距離接觸千鋒教育大咖名師,讓你輕松從入門到精通。

        tags:
        聲明:本站稿件版權(quán)均屬千鋒教育所有,未經(jīng)許可不得擅自轉(zhuǎn)載。
        10年以上業(yè)內(nèi)強(qiáng)師集結(jié),手把手帶你蛻變精英
        請(qǐng)您保持通訊暢通,專屬學(xué)習(xí)老師24小時(shí)內(nèi)將與您1V1溝通
        免費(fèi)領(lǐng)取
        今日已有369人領(lǐng)取成功
        劉同學(xué) 138****2860 剛剛成功領(lǐng)取
        王同學(xué) 131****2015 剛剛成功領(lǐng)取
        張同學(xué) 133****4652 剛剛成功領(lǐng)取
        李同學(xué) 135****8607 剛剛成功領(lǐng)取
        楊同學(xué) 132****5667 剛剛成功領(lǐng)取
        岳同學(xué) 134****6652 剛剛成功領(lǐng)取
        梁同學(xué) 157****2950 剛剛成功領(lǐng)取
        劉同學(xué) 189****1015 剛剛成功領(lǐng)取
        張同學(xué) 155****4678 剛剛成功領(lǐng)取
        鄒同學(xué) 139****2907 剛剛成功領(lǐng)取
        董同學(xué) 138****2867 剛剛成功領(lǐng)取
        周同學(xué) 136****3602 剛剛成功領(lǐng)取
        相關(guān)推薦HOT
        內(nèi)部表和外部表(重點(diǎn))

        hive外部表是使用external關(guān)鍵字并指定一個(gè)hdfs目錄創(chuàng)建的表。hive內(nèi)部表在創(chuàng)建時(shí)會(huì)在對(duì)應(yīng)hive目錄下創(chuàng)建相應(yīng)的文件夾,外部表則以指定文件夾為...詳情>>

        2022-09-02 17:21:00
        Flink checkpoint和savepoint區(qū)別

        Checkpoint是為runtime準(zhǔn)備的,Savepoint 是為用戶準(zhǔn)備的。Checkpoint 機(jī)制的目標(biāo)在于保證Flink作業(yè)意外崩潰重啟不影響exactly once 準(zhǔn)確性,通...詳情>>

        2022-09-02 16:59:22
        Flink State?

        State:指一個(gè)具體的Task/Operator的狀態(tài)。State可以被記錄,在失敗的情況下數(shù)據(jù)還可以恢復(fù),F(xiàn)link中有兩種基本類型的State: Keyed State, Op...詳情>>

        2022-09-02 16:59:19
        Flink反壓機(jī)制?

        Flink 內(nèi)部是基于producer-consumer模型來進(jìn)行消息傳遞的,F(xiàn)link的反壓設(shè)計(jì)也是基于這個(gè)模型。Flink 使用了高效有界的分布式阻塞隊(duì)列,就像 Jav...詳情>>

        2022-09-02 16:59:16
        大數(shù)據(jù)面數(shù)據(jù):Flink Allowed Lateness & Side OutPut?

        雖說水位線(Watermark)表明早于它的事件不應(yīng)該再出現(xiàn),但是接收到水位線以前的的消息是不可避免的,這就是所謂的遲到事件。實(shí)際上遲到事件是亂...詳情>>

        2022-09-02 16:59:00
        快速通道
        江都市| 眉山市| 江川县| 嘉善县| 仪征市| 宜都市| 抚宁县| 高要市| 怀化市| 咸丰县| 乐昌市| 镇远县| 行唐县| 湘西| 石家庄市| 嘉禾县| 江孜县| 岢岚县| 荆门市| 沈丘县| 城口县| 普兰店市| 平潭县| 虎林市| 农安县| 湖南省| 宣武区| 水城县| 台山市| 瑞昌市| 涿州市| 宿迁市| 汽车| 浦北县| 双辽市| 绥宁县| 随州市| 菏泽市| 益阳市| 延长县| 景泰县|