Pandas结构化json数据-CDA数据分析师官网

Pandas结构化json数据

2024-01-03

Pandas json_normalize 函数使用教程介绍

json_normalize 是 Pandas 库中一个强大的函数，用于将嵌套的 JSON 数据规范化成平面的 DataFrame。这对于处理包含嵌套结构的 JSON 数据非常有用，使其更容易分析和操作。在本教程中，我们将深入介绍 json_normalize 函数，并通过通俗的例子帮助你理解其参数的作用。

安装 Pandas

首先，确保你已经安装了 Pandas。如果没有安装，可以使用以下命令进行安装：pip install pandas使用 json_normalize基本用法让我们从最基本的用法开始。假设有如下嵌套的 JSON 数据：{
  "name":"John",
  "age":30,
  "address":{
    "city":"New York",
    "zip":"10001"
  }
}

  "name":"John",
  "age":30,
  "address":{
    "city":"New York",
    "zip":"10001"
  }

}

现在我们将使用 json_normalize 将其规范化成 DataFrame：import pandas as pd

# 嵌套的 JSON 数据
data = {
    "name": "John",
    "age": 30,
    "address": {
        "city": "New York",
        "zip": "10001"
    }
}

# 使用 json_normalize 规范化
df = pd.json_normalize(data)

# 打印 DataFrame
print(df)

# 嵌套的 JSON 数据
data = {
    "name": "John",
    "age": 30,
    "address": {
        "city": "New York",
        "zip": "10001"
    }
}

# 使用 json_normalize 规范化
df = pd.json_normalize(data)

# 打印 DataFrame

print(df) 运行上述代码，你将得到一个包含规范化数据的 DataFrame。处理嵌套数组json_normalize 也可以处理包含嵌套数组的 JSON 数据。

考虑以下 JSON：{
  "name":"John",
  "age":30,
  "skills":[
    {"language":"Python", "level":"Intermediate"},
    {"language":"JavaScript", "level":"Advanced"}
  ]
}

  "name":"John",
  "age":30,
  "skills":[
    {"language":"Python", "level":"Intermediate"},
    {"language":"JavaScript", "level":"Advanced"}
  ]

}

我们可以使用 record_path 参数指定要规范化的嵌套数组：# 嵌套数组的 JSON 数据
data_with_array = {
    "name": "John",
    "age": 30,
    "skills": [
        {"language": "Python", "level": "Intermediate"},
        {"language": "JavaScript", "level": "Advanced"}
    ]
}

# 使用 json_normalize 规范化，指定嵌套数组路径
df_with_array = pd.json_normalize(data_with_array, record_path='skills')

# 打印 DataFrame

data_with_array = {
    "name": "John",
    "age": 30,
    "skills": [
        {"language": "Python", "level": "Intermediate"},
        {"language": "JavaScript", "level": "Advanced"}
    ]
}

# 使用 json_normalize 规范化，指定嵌套数组路径
df_with_array = pd.json_normalize(data_with_array, record_path='skills')

# 打印 DataFrame

print(df_with_array)

通过指定 record_path 参数，我们将嵌套数组规范化成了 DataFrame。处理嵌套 JSONjson_normalize 还支持处理嵌套的 JSON 结构。

考虑以下 JSON：   {
  "name":"John",
  "age":30,
  "contact":{
    "email":"john@example.com",
    "phone":{
      "home":"123-456-7890",
      "work":"987-654-3210"
    }
  }

  "name":"John",
  "age":30,
  "contact":{
    "email":"john@example.com",
    "phone":{
      "home":"123-456-7890",
      "work":"987-654-3210"
    }
  }

}

我们可以使用 sep 参数指定嵌套层次的分隔符：# 嵌套 JSON 数据
data_nested = {
    "name": "John",
    "age": 30,
    "contact": {
        "email": "john@example.com",
        "phone": {
            "home": "123-456-7890",
            "work": "987-654-3210"
        }
    }
}

# 使用 json_normalize 规范化，指定嵌套层次分隔符
df_nested = pd.json_normalize(data_nested, sep='_')

# 打印 DataFrame
print(df_nested)

data_nested = {
    "name": "John",
    "age": 30,
    "contact": {
        "email": "john@example.com",
        "phone": {
            "home": "123-456-7890",
            "work": "987-654-3210"
        }
    }
}

# 使用 json_normalize 规范化，指定嵌套层次分隔符
df_nested = pd.json_normalize(data_nested, sep='_')

# 打印 DataFrame

print(df_nested)在这个例子中，我们通过指定 sep 参数，将嵌套的 JSON 结构规范化成了 DataFrame。

总结

通过本教程，你学习了如何使用 Pandas 中的 json_normalize 函数将嵌套的 JSON 数据规范化成易于处理的 DataFrame。我们介绍了基本用法以及如何处理嵌套数组和嵌套 JSON 结构。希望这些通俗易懂的例子能够帮助你更好地理解 json_normalize 函数的使用。

CDA数据分析师考试相关入口一览（建议收藏）：

▷ 想报名CDA认证考试，点击>>> “CDA报名” 了解CDA考试详情；

▷ 想学习CDA考试教材，点击>>> “CDA教材” 了解CDA考试详情；

▷ 想加入CDA考试题库，点击>>> “CDA题库” 了解CDA考试详情；

▷ 想了解CDA考试含金量，点击>>> “CDA含金量” 了解CDA考试详情；

DataFrame 数据规范化 pandas

数据分析咨询请扫描二维码

若不方便扫码，搜微信号：CDAshujufenxi

上一篇竞品分析是什么

下一篇为什么要对数据仓库进行分层设计？

Pandas结构化json数据

CDA考试动态

CDA报考指南

热门栏目

最新资讯

被统计公式劝退？这门极简课程让你14天学会用Python ...

【干货】如何用RFM模型精准识别高价值客户？ ...

CDA数据分析师就业班3月29日开班，仅剩1个名额 ...

【案例】网飞Netflix流量漏斗分析案例 ...

tensorflow_datasets 如何load本地的数据集？ ...

《CDA二级教材》试读版上线CDA网校，助你轻松拿下二 ...

【干货】3步带你画出用户DNA，精准营销更进一步 ...

什么是随机森林，它的优缺点是什么？：面试标准答案 ...

【干货】电商营收暴跌40%，如何排查？ ...

【干货】如何通过精细化运营提升 DAU 指标？ ...

【干货】AB test 在业务中的落地应用

自上而下的指标体系构建全攻略

解锁数据分析师高薪密码，CDA 脱产就业班助你逆袭！ ...

如何在mysql语句中查询一个表,但不包含某字段? ...

深度解析用户画像：数据运营的核心力量 ...

2025年AI智能体元年，数据分析师会被替代吗？ ...

【案例】业务数据分析方法之多维度拆解 ...

【干货】我手里有好几个产品，该怎么分配资源？-波 ...

【干货】5步搞定数据异常分析

CDA数据人才能力模型与认证体系简介