日B视频 亚洲,啪啪啪网站一区二区,91色情精品久久,日日噜狠狠色综合久,超碰人妻少妇97在线,999青青视频,亚洲一区二卡,让本一区二区视频,日韩网站推荐

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線(xiàn)課程
  • 觀看技術(shù)視頻
  • 寫(xiě)文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

spark為什么比mapreduce快?

京東云 ? 來(lái)源:jf_75140285 ? 作者:jf_75140285 ? 2024-09-06 09:45 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

spark為什么比mapreduce快?

首先澄清幾個(gè)誤區(qū):

1:兩者都是基于內(nèi)存計(jì)算的,任何計(jì)算框架都肯定是基于內(nèi)存的,所以網(wǎng)上說(shuō)的spark是基于內(nèi)存計(jì)算所以快,顯然是錯(cuò)誤的

2;DAG計(jì)算模型減少的是磁盤(pán)I/O次數(shù)(相比于mapreduce計(jì)算模型而言),而不是shuffle次數(shù),因?yàn)閟huffle是根據(jù)數(shù)據(jù)重組的次數(shù)而定,所以shuffle次數(shù)不能減少


所以總結(jié)spark比mapreduce快的原因有以下幾點(diǎn):

1:DAG相比hadoop的mapreduce在大多數(shù)情況下可以減少磁盤(pán)I/O次數(shù)

因?yàn)閙apreduce計(jì)算模型只能包含一個(gè)map和一個(gè)reduce,所以reduce完后必須進(jìn)行落盤(pán),而DAG可以連續(xù)shuffle的,也就是說(shuō)一個(gè)DAG可以完成好幾個(gè)

mapreduce,所以dag只需要在最后一個(gè)shuffle落盤(pán),就比mapreduce少了,總shuffle次數(shù)越多,減少的落盤(pán)次數(shù)就越多


2:spark shuffle 的優(yōu)化

mapreduce在shuffle時(shí)默認(rèn)進(jìn)行排序,spark在shuffle時(shí)則只有部分場(chǎng)景才需要排序(bypass技師不需要排序),排序是非常耗時(shí)的,這樣就可以加快shuffle速度


3:spark支持將需要反復(fù)用到的數(shù)據(jù)進(jìn)行緩存

所以對(duì)于下次再次使用此rdd時(shí),不再再次計(jì)算,而是直接從緩存中獲取,因此可以減少數(shù)據(jù)加載耗時(shí),所以更適合需要迭代計(jì)算的機(jī)器學(xué)習(xí)算法

4:任務(wù)級(jí)別并行度上的不同

mapreduce采用多進(jìn)程模型,而spark采用了多線(xiàn)程模型,多進(jìn)程模型的好處是便于細(xì)粒度控制每個(gè)任務(wù)占用的資源,但每次任務(wù)的啟動(dòng)都會(huì)消耗一定的啟動(dòng)時(shí)間,即mapreduce的map task 和reduce task是進(jìn)程級(jí)別的,都是jvm進(jìn)程,每次啟動(dòng)都需要重新申請(qǐng)資源,消耗不必要的時(shí)間,而spark task是基于線(xiàn)程模型的,通過(guò)復(fù)用線(xiàn)程池中的線(xiàn)程來(lái)減少啟動(dòng),關(guān)閉task所需要的開(kāi)銷(xiāo)(多線(xiàn)程模型也有缺點(diǎn),由于同節(jié)點(diǎn)上所有任務(wù)運(yùn)行在一個(gè)進(jìn)行中,因此,會(huì)出現(xiàn)嚴(yán)重的資源爭(zhēng)用,難以細(xì)粒度控制每個(gè)任務(wù)占用資源)

審核編輯 黃宇

聲明:本文內(nèi)容及配圖由入駐作者撰寫(xiě)或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 內(nèi)存
    +關(guān)注

    關(guān)注

    9

    文章

    3238

    瀏覽量

    76528
  • SPARK
    +關(guān)注

    關(guān)注

    1

    文章

    108

    瀏覽量

    21292
  • MapReduce
    +關(guān)注

    關(guān)注

    0

    文章

    45

    瀏覽量

    6914
收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    首屆中國(guó)NVIDIA DGX Spark黑客松大賽開(kāi)啟報(bào)名

    倒計(jì)時(shí)啟動(dòng)!首屆中國(guó) NVIDIA DGX Spark 黑客松(Hackathon)將于 3 月 13 日 - 3 月 28 日正式開(kāi)啟報(bào)名!本屆賽事以“算力破局、AI 落地”為核心導(dǎo)向,依托
    的頭像 發(fā)表于 03-14 16:39 ?2751次閱讀

    NVIDIA DGX Spark助力高等教育領(lǐng)域重大項(xiàng)目

    在全球各地的頂尖高校,NVIDIA DGX Spark 桌面超級(jí)計(jì)算機(jī)正將數(shù)據(jù)中心級(jí)的 AI 能力帶到實(shí)驗(yàn)室臺(tái)前、教師辦公室里和學(xué)生的終端設(shè)備上。在地球最南端的南極,也有一臺(tái) DGX Spark 正在威斯康星大學(xué)麥迪遜分校運(yùn)營(yíng)的 IceCube 中微子天文臺(tái)中高速運(yùn)轉(zhuǎn)。
    的頭像 發(fā)表于 03-09 16:33 ?713次閱讀

    全新軟件與模型優(yōu)化為NVIDIA DGX Spark注入強(qiáng)大動(dòng)力

    自發(fā)布以來(lái),NVIDIA 通過(guò)持續(xù)的軟件優(yōu)化以及與軟件合作伙伴和開(kāi)源社區(qū)的緊密協(xié)作,不斷提升基于 Grace Blackwell 架構(gòu)的 DGX Spark 的性能。這些舉措在推理、訓(xùn)練和創(chuàng)意工作流方面都取得了顯著的成效。
    的頭像 發(fā)表于 01-09 10:17 ?897次閱讀

    NVIDIA DGX Spark桌面級(jí)AI超級(jí)計(jì)算機(jī)助力開(kāi)發(fā)者構(gòu)建AI模型

    開(kāi)源 AI 正在加速各行各業(yè)的創(chuàng)新,NVIDIA DGX Spark 將幫助開(kāi)發(fā)者將創(chuàng)新轉(zhuǎn)化為影響力。
    的頭像 發(fā)表于 01-09 09:49 ?760次閱讀

    如何在DGX Spark上運(yùn)行NVIDIA Omniverse

    首先感謝 Vigor 同學(xué)第一時(shí)間的分享,以下是具體如何在 DGX Spark 上運(yùn)行 Omniverse 的方法。
    的頭像 發(fā)表于 12-17 10:13 ?967次閱讀
    如何在DGX <b class='flag-5'>Spark</b>上運(yùn)行NVIDIA Omniverse

    NVIDIA DGX Spark系統(tǒng)恢復(fù)過(guò)程與步驟

    在使用 NVIDIA DGX Spark 的過(guò)程中,可能會(huì)出現(xiàn)配置故障,而導(dǎo)致開(kāi)發(fā)中斷的問(wèn)題,本篇教程將帶大家了解如何一步步完成系統(tǒng)恢復(fù)。
    的頭像 發(fā)表于 11-28 09:46 ?6000次閱讀
    NVIDIA DGX <b class='flag-5'>Spark</b>系統(tǒng)恢復(fù)過(guò)程與步驟

    NVIDIA DGX Spark助力構(gòu)建自己的AI模型

    2025 年 1 月 6 日,NVIDIA 正式宣布其 Project DIGITS 項(xiàng)目,并于 3 月 18 日更名為 NVIDIA DGX Spark,進(jìn)一步公布了產(chǎn)品細(xì)節(jié)。DGX Spark
    的頭像 發(fā)表于 11-21 09:25 ?1595次閱讀
    NVIDIA DGX <b class='flag-5'>Spark</b>助力構(gòu)建自己的AI模型

    在NVIDIA DGX Spark平臺(tái)上對(duì)NVIDIA ConnectX-7 200G網(wǎng)卡配置教程

    在 NVIDIA DGX Spark 平臺(tái)上對(duì) NVIDIA ConnectX-7 200G 網(wǎng)卡進(jìn)行配置時(shí),會(huì)遇到“4 個(gè)邏輯端口”現(xiàn)象。理解背后的真相是后續(xù)所有配置的基礎(chǔ)。本文將從此現(xiàn)象入手,逐步解析其原理,并提供從基礎(chǔ)配置到深度性能驗(yàn)證的完整流程。
    的頭像 發(fā)表于 11-21 09:19 ?6136次閱讀
    在NVIDIA DGX <b class='flag-5'>Spark</b>平臺(tái)上對(duì)NVIDIA ConnectX-7 200G網(wǎng)卡配置教程

    NVIDIA DGX Spark快速入門(mén)指南

    NVIDIA DGX Spark 已正式向 AI 開(kāi)發(fā)者交付,對(duì)于剛?cè)胧值娜?DGX Spark,該如何進(jìn)行初始化設(shè)置?本篇文章將引導(dǎo)您完成 DGX Spark 首次設(shè)置。在初始設(shè)置的過(guò)程中,您
    的頭像 發(fā)表于 11-17 14:11 ?7174次閱讀
    NVIDIA DGX <b class='flag-5'>Spark</b>快速入門(mén)指南

    NVIDIA黃仁勛向SpaceX馬斯克交付DGX Spark

    革新于星艦基地開(kāi)始。NVIDIA 創(chuàng)始人兼首席執(zhí)行官黃仁勛親手將全球迄今為止最小的 AI 超級(jí)計(jì)算機(jī) NVIDIA DGX Spark 交付給埃隆·馬斯克,拉開(kāi)了該產(chǎn)品上市的序幕。
    的頭像 發(fā)表于 10-21 11:12 ?1172次閱讀

    NVIDIA DGX Spark新一代AI超級(jí)計(jì)算機(jī)正式交付

    NVIDIA 創(chuàng)始人兼首席執(zhí)行官黃仁勛在 SpaceX 向埃隆·馬斯克交付 DGX Spark。
    的頭像 發(fā)表于 10-21 10:41 ?1555次閱讀

    NVIDIA DGX Spark桌面AI計(jì)算機(jī)開(kāi)啟預(yù)訂

    DGX Spark 現(xiàn)已開(kāi)啟預(yù)訂!麗臺(tái)科技作為 NVIDIA 授權(quán)分銷(xiāo)商,提供從產(chǎn)品到服務(wù)的一站式解決方案,助力輕松部署桌面 AI 計(jì)算機(jī)。
    的頭像 發(fā)表于 09-23 17:20 ?1579次閱讀
    NVIDIA DGX <b class='flag-5'>Spark</b>桌面AI計(jì)算機(jī)開(kāi)啟預(yù)訂

    使用NVIDIA GPU加速Apache Spark中Parquet數(shù)據(jù)掃描

    的方式組織數(shù)據(jù),這使得 Parquet 在查詢(xún)時(shí)僅讀取所需的列,而無(wú)需掃描整行數(shù)據(jù),即可實(shí)現(xiàn)高性能的查詢(xún)和分析。高效的數(shù)據(jù)布局使 Parquet 在現(xiàn)代分析生態(tài)系統(tǒng)中成為了受歡迎的選擇,尤其是在 Apache Spark 工作負(fù)載中。
    的頭像 發(fā)表于 07-23 10:52 ?1249次閱讀
    使用NVIDIA GPU加速Apache <b class='flag-5'>Spark</b>中Parquet數(shù)據(jù)掃描

    什么是充協(xié)議,充協(xié)議芯片的作用與特點(diǎn)

    一、什么是充協(xié)議? 充協(xié)議是一種通過(guò)提高充電效率來(lái)縮短設(shè)備充電時(shí)間的電池充電技術(shù)。它是通過(guò)在充電器和設(shè)備之間建立一種溝通機(jī)制,充電器能夠根據(jù)設(shè)備的需求和狀態(tài),調(diào)整輸出的電壓和電流。這種溝通機(jī)制由
    的頭像 發(fā)表于 05-12 14:02 ?6400次閱讀
    什么是<b class='flag-5'>快</b>充協(xié)議,<b class='flag-5'>快</b>充協(xié)議芯片的作用與特點(diǎn)
    鄂州市| 崇礼县| 双鸭山市| 黔西县| 浦江县| 鹤岗市| 兴和县| 两当县| 井研县| 岳阳市| 固阳县| 德令哈市| 象州县| 财经| 诸暨市| 修武县| 桑植县| 鄂托克前旗| 汉源县| 东阳市| 保德县| 永泰县| 鹤山市| 文昌市| 肇东市| 张家口市| 富宁县| 石首市| 蒲城县| 青州市| 曲松县| 满洲里市| 汝城县| 河曲县| 毕节市| 方山县| 巢湖市| 东莞市| 铁岭市| 讷河市| 昂仁县|