首页 > 编程 > Python > 正文

深入分析python数据挖掘 Json结构分析

2020-02-22 23:46:47
字体:
来源:转载
供稿:网友

json是一种轻量级的数据交换格式,也可以说是一种配置文件的格式

这种格式的文件是我们在数据处理经常会遇到的

python提供内置的模块json,只需要在使用前导入即可

 

你可以通过帮助函数查看json的帮助文档

json常用的方法有load、loads、dump以及dumps,这个都属于python初级,我不做过多解释

json可以结合数据库一起使用,在这以后要处理大量数据时非常有用

下面我们正式来利用数据挖掘对json文件进行处理

现在很多网站都运用了Ajax,所以一般很多都是XHR文件

通过这里我想利用一个地图网站来演示

我们通过浏览器的调试获取了相关url

https://ditu.amap.com/service/poiInfo?id=B001B0IZY1&query_type=IDQ

下面我们通过requests模块中的get方法,模拟浏览器发出的http请求,并返回的到的结果对象

代码如下

# coding=utf-8__Author__ = "susmote"import requestsurl = "https://ditu.amap.com/service/poiInfo?id=B001B0IZY1&query_type=IDQ"resp = requests.get(url)print(resp.text[0:200])

在终端中运行结果如下

数据已经获取到了,但是为了接下来能使用这些数据,我们需要利用json模块对这些数据进行分析

代码如下

import requestsimport jsonurl = "https://ditu.amap.com/service/poiInfo?id=B001B0IZY1&query_type=IDQ"resp = requests.get(url)json_dict = json.loads(resp.text)print(type(json_dict))print(json_dict.keys())

简单讲一下上面的代码:

导入json模块,然后调用loads方法,将返回的文本作为方法的参数传入 

在终端中运行结果如下 

 可以看出,转换的结果是与json字符串对应的字典,因为type(json_dict)返回的是<class 'dict'>

因为对象是一个字典,所以我们可以调用字典的方法,在这里我们调用的就是keys方法

结果返回三个键,即status、searcOpt、data

下面我们来查看data键里面的数据

import requestsimport jsonurl = "https://ditu.amap.com/service/poiInfo?id=B001B0IZY1&query_type=IDQ"resp = requests.get(url)json_dict = json.loads(resp.text)print(json_dict['data'])

下面在终端中运行这一段代码

可以看到里面有很多我们需要的数据,如 

发表评论 共有条评论
用户名: 密码:
验证码: 匿名发表