Maison > développement back-end > Tutoriel Python > Impossible de décomposer le JSON imbriqué dans le dataframe Spark

Impossible de décomposer le JSON imbriqué dans le dataframe Spark

WBOY
Libérer: 2024-02-11 10:51:03
avant
465 Les gens l'ont consulté

无法分解 Spark 数据框中的嵌套 JSON

Contenu des questions

Je suis nouveau sur Spark. J'essaie d'aplatir le dataframe mais je ne parviens pas à le faire via "exploser".

La structure originale du bloc de données est la suivante :

id|approvaljson
1|[{"approvertype":"1st line manager","status":"approved"},{"approvertype":"2nd line manager","status":"approved"}]
2|[{"approvertype":"1st line manager","status":"approved"},{"approvertype":"2nd line manager","status":"rejected"}]
Copier après la connexion

Je dois le convertir vers le schéma suivant ?

id|approvaltype|status
1|1st line manager|approved
1|2nd line manager|approved
2|1st line manager|approved
2|2nd line manager|rejected
Copier après la connexion

Je l'ai essayé

df_exploded = df.withcolumn("approvaljson", explode("approvaljson"))
Copier après la connexion

Mais j'ai eu l'erreur :

Cannot resolve "explode(ApprovalJSON)" due to data type mismatch:
parameter 1 requires ("ARRAY" or "MAP") type, however, "ApprovalJSON"
is of "STRING" type.;
Copier après la connexion


Réponse correcte


Analysez d'abord la chaîne de type json dans un tableau de structures, puis utilisez inline pour diviser le tableau en lignes et colonnes

df1 = df.withcolumn("approvaljson", f.from_json("approvaljson", schema="array<struct<approvertype string, status string>>"))
df1 = df1.select("id", f.inline('approvaljson'))
Copier après la connexion

Résultats

df1.show()

+---+----------------+--------+
| ID|    ApproverType|  Status|
+---+----------------+--------+
|  1|1st Line Manager|Approved|
|  1|2nd Line Manager|Approved|
|  2|1st Line Manager|Approved|
|  2|2nd Line Manager|Rejected|
+---+----------------+--------+
Copier après la connexion

Ce qui précède est le contenu détaillé de. pour plus d'informations, suivez d'autres articles connexes sur le site Web de PHP en chinois!

Étiquettes associées:
source:stackoverflow.com
Déclaration de ce site Web
Le contenu de cet article est volontairement contribué par les internautes et les droits d'auteur appartiennent à l'auteur original. Ce site n'assume aucune responsabilité légale correspondante. Si vous trouvez un contenu suspecté de plagiat ou de contrefaçon, veuillez contacter admin@php.cn
Tutoriels populaires
Plus>
Derniers téléchargements
Plus>
effets Web
Code source du site Web
Matériel du site Web
Modèle frontal