91超碰碰碰碰久久久久久综合_超碰av人澡人澡人澡人澡人掠_国产黄大片在线观看画质优化_txt小说免费全本

溫馨提示×

溫馨提示×

您好,登錄后才能下訂單哦!

密碼登錄×
登錄注冊×
其他方式登錄
點擊 登錄注冊 即表示同意《億速云用戶服務條款》

Spark在運行轉換中如何通過算子對RDD進行轉換

發布時間:2021-12-10 13:36:16 來源:億速云 閱讀:246 作者:小新 欄目:云計算

這篇文章主要介紹Spark在運行轉換中如何通過算子對RDD進行轉換,文中介紹的非常詳細,具有一定的參考價值,感興趣的小伙伴們一定要看完!

算子運行過程

下圖描述了Spark在運行轉換中通過算子對RDD進行轉換。 算子是RDD中定義的函數,可以對RDD中的數據進行轉換和操作。

Spark在運行轉換中如何通過算子對RDD進行轉換

1、輸入:在Spark程序運行中,數據從外部數據空間(如分布式存儲:textFile讀取HDFS等,parallelize方法輸入Scala集合或數據)輸入Spark,數據進入Spark運行時數據空間,轉化為Spark中的數據塊,通過BlockManager進行管理。
2、運行:在Spark數據輸入形成RDD后便可以通過變換算子,如filter等,對數據進行操作并將RDD轉化為新的RDD,通過Action算子,觸發Spark提交作業。 如果數據需要復用,可以通過Cache算子,將數據緩存到內存。
3、輸出:程序運行結束數據會輸出Spark運行時空間,存儲到分布式存儲中(如saveAsTextFile輸出到HDFS),或Scala數據或集合中(collect輸出到Scala集合,count返回Scala int型數據)。

算子分類

大致可以分為三大類算子:
1、Value數據類型的Transformation算子,這種變換并不觸發提交作業,針對處理的數據項是Value型的數據。
2、Key-Value數據類型的Transfromation算子,這種變換并不觸發提交作業,針對處理的數據項是Key-Value型的數據對。
3、Action算子,這類算子會觸發SparkContext提交Job作業。

以上是“Spark在運行轉換中如何通過算子對RDD進行轉換”這篇文章的所有內容,感謝各位的閱讀!希望分享的內容對大家有幫助,更多相關知識,歡迎關注億速云行業資訊頻道!

向AI問一下細節

免責聲明:本站發布的內容(圖片、視頻和文字)以原創、轉載和分享為主,文章觀點不代表本網站立場,如果涉及侵權請聯系站長郵箱:is@yisu.com進行舉報,并提供相關證據,一經查實,將立刻刪除涉嫌侵權內容。

AI

明星| 定西市| 洪洞县| 山阳县| 怀仁县| 建瓯市| 靖西县| 运城市| 高雄市| 泸溪县| 双江| 日喀则市| 邯郸县| 临湘市| 新沂市| 正阳县| 正镶白旗| 武山县| 钟山县| 深州市| 廉江市| 莲花县| 商城县| 延边| 芮城县| 巴彦县| 泗水县| 宾川县| 九龙坡区| 泽库县| 高要市| 三门县| 建平县| 芜湖市| 微博| 卓尼县| 揭西县| 龙山县| 盖州市| 定结县| 涟水县|