分享python数据统计的一些小技巧


Posted in Python onJuly 21, 2016

最近在用python做数据统计,这里总结了一些最近使用时查找和总结的一些小技巧,希望能帮助在做这方面时的一些童鞋。有些技巧是很平常的用法,平时我们没有注意,但是在特定场景,这些小方法还是能带来很大的帮助。

1.在字典中将键映射到多个值上面

{'b': [4, 5, 6], 
'a': [1, 2, 3]}

有时候我们在统计相同key值的时候,希望把所有相同key的条目添加到以key为键的一个字典中,然后再进行各种操作,这时候我们就可以使用下面的代码进行操作:

from collections import defaultdict
d = defaultdict(list)
print(d)
d['a'].append(1)
d['a'].append(2)
d['a'].append(3)
d['b'].append(4)
d['b'].append(5)
d['b'].append(6)
print(d)
print(d.get("a"))
print(d.keys())
print([d.get(i) for i in d])

这里是使用了collections中的方法,这里面还拥有很多有用的方法,我们有时间在继续进行深入了解。

上面代码运行结果:

defaultdict(, {})
defaultdict(, {'b': [4, 5, 6], 'a': [1, 2, 3]})
[1, 2, 3]
dict_keys(['b', 'a'])
[[4, 5, 6], [1, 2, 3]]

我们将数据填入之后,相当于进行快速分组,然后遍历每个组就可以统计一些我们需要的数据。

2.迅速转换字典键值对

data = {...}
zip(data.values(), data.keys())

data是我们的格式数据,使用zip后进行快速键值转换,然后可以使用max,min之类函数进行数据操作。

3.通过公共键对字典进行排序

from operator import itemgetter
data = [
  {'name': "bran", "uid": 101},
  {'name': "xisi", "uid": 102},
  {'name': "land", "uid": 103}
]
print(sorted(data, key=itemgetter("name")))
print(sorted(data, key=itemgetter("uid")))

数据格式就是data,我们想要对name或者uid进行排序我们就是用代码中的方法。
运行结果:

[{'name': 'bran', 'uid': 101}, {'name': 'land', 'uid': 103}, {'name': 'xisi', 'uid': 102}]
[{'name': 'bran', 'uid': 101}, {'name': 'xisi', 'uid': 102}, {'name': 'land', 'uid': 103}]

正如我们期望中的一样

4.对列表中的多个字典根据某一字段进行分组

注意注意,在进行分组前要首先对数据进行排序处理,排序字段根据实际要求来选择

即将处理的数据:

rows = [
  {'name': "bran", "uid": 101, "class": 13},
  {'name': "xisi", "uid": 101, "class": 11},
  {'name': "land", "uid": 103, "class": 10}
]

期望处理结果:

{
101: [{'name': 'xisi', 'class': 11, 'uid': 101},{'name': 'bran', 'class': 13, 'uid': 101}],
103: [{'name': 'land', 'class': 10, 'uid': 103}]
}

我们按照uid进行分组,这里只是演示,uid一般也不会重复。

这个比较复杂一点,我们一部一步来分解

some = [('a', [1, 2, 3]), ('b', [4, 5, 6])]
print(dict(some))

结果:

{'b': [4, 5, 6], 'a': [1, 2, 3]}

这里我们的目的是将元组转换成字典,这个很简单,应该都能看懂。接着我们来下一步对待处理数据进行排序:

data_one = sorted(rows, key=itemgetter("class"))
print(data_one)
data_two = sorted(rows, key=lambda x: (x["uid"], x["class"]))
print(data_two)

这里我们提供两种排序方式原理相同,只是样式稍有区别,第一种data_one是直接使用itemgetter,按照我们前面使用过得,直接按照某一字段进行排序,可是有时候我们会有另一种要求:

先按照某一字段排序,当第一字段重复时,再按照另一字段排序。

这时我们就用第二种方法,进行多字段值排序。
排序结果如下:

[{'name': 'land', 'class': 10, 'uid': 103}, {'name': 'xisi', 'class': 11, 'uid': 101}, {'name': 'bran', 'class': 13, 'uid': 101}]
[{'name': 'xisi', 'class': 11, 'uid': 101}, {'name': 'bran', 'class': 13, 'uid': 101}, {'name': 'land', 'class': 10, 'uid': 103}]

结果大家慢慢看一下,还是略有差别。

接下来就进行最后一步了,将我们刚才讲的两种方式结合起来使用:

data = dict([(g, list(k)) for g, k in groupby(data_two, key=lambda x: x["uid"])])
print(data)

我们对排序好的数据进行分组,然后生成元组列表,最后将其转换成字典,这里大功告成,我们成功将数据进行分组。

python数据统计的一些小技巧就分享到这,有需要的可以参考学习。

Python 相关文章推荐
Python实现检测文件MD5值的方法示例
Apr 11 Python
基于numpy.random.randn()与rand()的区别详解
Apr 17 Python
Selenium鼠标与键盘事件常用操作方法示例
Aug 13 Python
python并发和异步编程实例
Nov 15 Python
详解【python】str与json类型转换
Apr 29 Python
如何用Python来理一理红楼梦里的那些关系
Aug 14 Python
Python+OpenCV+图片旋转并用原底色填充新四角的例子
Dec 12 Python
浅谈对pytroch中torch.autograd.backward的思考
Dec 27 Python
自定义Django Form中choicefield下拉菜单选取数据库内容实例
Mar 13 Python
Python如何输出整数
Jun 07 Python
python中翻译功能translate模块实现方法
Dec 17 Python
关于pytest结合csv模块实现csv格式的数据驱动问题
May 30 Python
python中print的不换行即时输出的快速解决方法
Jul 20 #Python
Python全局变量用法实例分析
Jul 19 #Python
python对象及面向对象技术详解
Jul 19 #Python
python异常和文件处理机制详解
Jul 19 #Python
python线程、进程和协程详解
Jul 19 #Python
浅谈python字符串方法的简单使用
Jul 18 #Python
python读取oracle函数返回值
Jul 18 #Python
You might like
PHP用SAX解析XML的实现代码与问题分析
2011/08/22 PHP
php使用sql数据库 获取字段问题介绍
2013/08/12 PHP
浅谈PHP的数据库接口和技术
2016/12/09 PHP
thinkphp5框架结合mysql实现微信登录和自定义分享链接与图文功能示例
2019/08/13 PHP
javascript 多级checkbox选择效果
2009/08/20 Javascript
几种设置表单元素中文本输入框不可编辑的方法总结
2013/11/25 Javascript
javascript 获取HTML DOM父、子、临近节点
2014/06/16 Javascript
jQuery 1.9移除了$.browser可以使用$.support来替代
2014/09/03 Javascript
JavaScript定义变量和变量优先级问题探讨
2014/10/11 Javascript
浅谈javascript中createElement事件
2014/12/05 Javascript
JavaScript简单下拉菜单实例代码
2015/09/07 Javascript
省市区三级联动jquery实现代码
2020/04/15 Javascript
js拼接html字符串的注意事项
2016/10/13 Javascript
史上最全JavaScript常用的简写技巧(推荐)
2017/08/17 Javascript
vue 动态绑定背景图片的方法
2018/08/10 Javascript
vue-cli3.0实现一个多页面应用的历奇经历记录总结
2020/03/16 Javascript
解决vscode进行vue格式化,会自动补分号和双引号的问题
2020/10/26 Javascript
[49:13]DOTA2上海特级锦标赛C组资格赛#1 OG VS LGD第一局
2016/02/27 DOTA
跟老齐学Python之不要红头文件(1)
2014/09/28 Python
python类装饰器用法实例
2015/06/04 Python
利用python为运维人员写一个监控脚本
2018/03/25 Python
Python和Go语言的区别总结
2019/02/20 Python
wxPython绘图模块wxPyPlot实现数据可视化
2019/11/19 Python
Django 批量插入数据的实现方法
2020/01/12 Python
tensorflow 固定部分参数训练,只训练部分参数的实例
2020/01/20 Python
python中rc1什么意思
2020/06/19 Python
使用Python将xmind脑图转成excel用例的实现代码(一)
2020/10/12 Python
iframe在移动端的缩放的示例代码
2018/10/12 HTML / CSS
国际贸易个人求职信范文
2014/01/04 职场文书
食堂采购员岗位职责
2014/03/17 职场文书
乡镇纠风工作实施方案
2014/03/22 职场文书
跳槽求职信范文
2014/05/26 职场文书
水利水电专业自荐信
2014/07/08 职场文书
2014市国税局对照检查材料思想汇报
2014/09/23 职场文书
新手入门Mysql--概念
2021/06/18 MySQL
Java详细解析==和equals的区别
2022/04/07 Java/Android