麻豆国内精品欧美在线,国产一级淫片a免费播放口之,日韩综合在线观看

亚洲视频二区_亚洲欧洲日本天天堂在线观看_日韩一区二区在线观看_中文字幕不卡一区

公告：魔扣目錄網為廣大站長提供免費收錄網站服務，提交前請做好本站友鏈：【網站目錄：http://www.430618.com 】，免友鏈快審服務（50元/站），

網站：51998
待審：31
小程序：12
文章：1030137
會員：747

首頁 > 新聞資訊 > IT業界 >正文

無法分解 Spark 數據框中的嵌套 JSON

發布時間：2024-03-08 22:17:06 作者：網友整理

問題內容

我是 spark 新手。我試圖展平數據框，但未能通過“爆炸”做到這一點。

原始數據框架構如下：

id|approvaljson
1|[{"approvertype":"1st line manager","status":"approved"},{"approvertype":"2nd line manager","status":"approved"}]
2|[{"approvertype":"1st line manager","status":"approved"},{"approvertype":"2nd line manager","status":"rejected"}]

登錄后復制

我需要將其轉換為以下架構？

id|approvaltype|status
1|1st line manager|approved
1|2nd line manager|approved
2|1st line manager|approved
2|2nd line manager|rejected

登錄后復制

我已經嘗試過

df_exploded = df.withcolumn("approvaljson", explode("approvaljson"))

登錄后復制

但是我得到了錯誤：

Cannot resolve "explode(ApprovalJSON)" due to data type mismatch:
parameter 1 requires ("ARRAY" or "MAP") type, however, "ApprovalJSON"
is of "STRING" type.;

登錄后復制

正確答案

首先將類似 json 的字符串解析為結構數組，然后使用 inline 將數組分解為行和列

df1 = df.withcolumn("approvaljson", f.from_json("approvaljson", schema="array"))
df1 = df1.select("id", f.inline('approvaljson'))

登錄后復制

結果

df1.show()

+---+----------------+--------+
| ID|    ApproverType|  Status|
+---+----------------+--------+
|  1|1st Line Manager|Approved|
|  1|2nd Line Manager|Approved|
|  2|1st Line Manager|Approved|
|  2|2nd Line Manager|Rejected|
+---+----------------+--------+

登錄后復制

分享到：

標簽：字符串解析