小贝子编程

PySpark - create new key

本文关键字：key new create PySpark python apache-spark pyspark apache-spark-sql
更新时间 : 2023-09-23
英文 : PySpark - create new key

我有一个rdd列表，如

{
"name": "adam",
"gender": "male",
"new_column": "white,black,yellow"
}

如何用键值创建新的rdd:

{
"name": "adam",
"gender": "male",
"new_column": "white"
}
{
"name": "adam",
"gender": "male",
"new_column": "black"
}
{
"name": "adam",
"gender": "male",
"new_column": "yellow"
}

谁能给我指路吗

df.printSchema()
root
|-- name: string (nullable = true)
|-- gender: string (nullable = true)
|-- new_column: string (nullable = true)

从Spark 1.5开始，您可以使用split和explode函数如下:

from pyspark.sql import functions as F
df.withColumn("new_column", F.explode(F.split("new_column", ",")))

您可以在pyspark函数文档

中找到您可以在pyspark中使用的所有函数

最新更新

在Shopify中隐藏折扣代码输入字段
无法导入外部 NPM 包来制作角度库
掩码输入字段的长度验证
用点分隔符分隔列
在Mac上将Xerces库构建为通用二进制文件的问题
在同级组件之间使用共享服务共享数据，在Angular中返回空
为什么我的 C 结构在输入中没有获取任何数据？
org.keycloak.adapters.springboot.KeycloakSpringBootConfigResolver 不存在
为一个非常大的数据库优化SPARQL查询
Python线程请求计数
将结果保存为pyspark多输出循环中的数据帧
这两个数组的区别是什么?
如何在主线程上运行async await
React Native FlatList ListEmptyComponent总是显示，即使不是空的
Android Emulator未在M1上运行
我的' collate_fn '函数在传递给Trainer函数的collate_fn参数时得到空数据
访问documentRoot以外的所有图像，而不是Apache windows
如何从React或Javascript中的对象属性中获取值
Redux工具箱:从切片文件导出一个自定义钩子来访问动作，而不是导出所有的动作，然后再次调用调度? &
CSS难题:孩子们总是闯入多行
贴现率，公式
使用 Javascript 的嵌套数组循环生成和排序所有象限中 (0,0) 周围的笛卡尔坐标
如何在Windows上添加现有的mysql模式
从Google VPS中恢复删除的文件夹
ffmpeg/映射代码的几个输出
r语言 - 在部署到shinyapps.io的Shiny应用中使用readClipboard()的问题 &
如何适应事件SelectionChange代码在事件计算工作?
类型错误：.map 不是一个函数不明白出了什么问题
在Rust中定义无限嵌套HashMap
为什么有些符号表达式没有简化？

PySpark - create new key

相关内容

最新更新

热门标签：