Python中如何优雅的合并两个字典(dict)方法示例


Posted in Python onAugust 09, 2017

前言

字典是Python中最强大的数据类型之一,本文将给大家详细介绍关于Python合并两个字典(dict)的相关内容,分享出来供大家参考学习,话不多说了,来一起看看详细的介绍吧。

一行代码合并两个dict

假设有两个dict x和y,合并成一个新的dict,不改变 x和y的值,例如

x = {'a': 1, 'b': 2}
 y = {'b': 3, 'c': 4}

期望得到一个新的结果Z,如果key相同,则y覆盖x。期望的结果是

>>> z
{'a': 1, 'b': 3, 'c': 4}

在PEP448中,有个新的语法可以实现,并且在python3.5中支持了该语法,合并代码如下

z = {**x, **y}

妥妥的一行代码。 由于现在很多人还在用python2,对于python2和python3.0-python3.4的人来说,有一个比较优雅的方法,但是需要两行代码。

z = x.copy()
z.update(y)

上面的方法,y都会覆盖x里的内容,所以最终结果b=3.

不使用python3.5如何一行完成了

如果您还没有使用Python 3.5,或者需要编写向后兼容的代码,并且您希望在单个表达式中运行,则最有效的方法是将其放在一个函数中:

def merge_two_dicts(x, y):
 """Given two dicts, merge them into a new dict as a shallow copy."""
 z = x.copy()
 z.update(y)
 return z

然后一行代码完成调用:

z = merge_two_dicts(x, y)

你也可以定义一个函数,合并多个dict,例如

def merge_dicts(*dict_args):
 """
 Given any number of dicts, shallow copy and merge into a new dict,
 precedence goes to key value pairs in latter dicts.
 """
 result = {}
 for dictionary in dict_args:
 result.update(dictionary)
 return result

然后可以这样使用

z = merge_dicts(a, b, c, d, e, f, g)

所有这些里面,相同的key,都是后面的覆盖前面的。

一些不够优雅的示范

items

有些人会使用这种方法:

z = dict(x.items() + y.items())

这其实就是在内存中创建两个列表,再创建第三个列表,拷贝完成后,创建新的dict,删除掉前三个列表。这个方法耗费性能,而且对于python3,这个无法成功执行,因为items()返回是个对象。

>>> c = dict(a.items() + b.items())
Traceback (most recent call last):
 File "<stdin>", line 1, in <module>
TypeError: unsupported operand type(s) for +: 'dict_items' and 
'dict_items'

你必须明确的把它强制转换成list,z = dict(list(x.items()) + list(y.items())) ,这太浪费性能了。 另外,想以来于items()返回的list做并集的方法对于python3来说也会失败,而且,并集的方法,导致了重复的key在取值时的不确定,所以,如果你对两个dict合并有优先级的要求,这个方法就彻底不合适了。

>>> x = {'a': []}
>>> y = {'b': []}
>>> dict(x.items() | y.items())
Traceback (most recent call last):
 File "<stdin>", line 1, in <module>
TypeError: unhashable type: 'list'

这里有一个例子,其中y应该具有优先权,但是由于任意的集合顺序,x的值被保留:

>>> x = {'a': 2}
>>> y = {'a': 1}
>>> dict(x.items() | y.items())
{'a': 2}

构造函数

也有人会这么用

z = dict(x, **y)

这样用很好,比前面的两步的方法高效多了,但是可阅读性差,不够pythonic,如果当key不是字符串的时候,python3中还是运行失败

>>> c = dict(a, **b)
Traceback (most recent call last):
 File "<stdin>", line 1, in <module>
TypeError: keyword arguments must be strings

Guido van Rossum 大神说了:宣告dict({}, {1:3})是非法的,因为毕竟是滥用机制。虽然这个方法比较hacker,但是太投机取巧了。

一些性能较差但是比较优雅的方法

下面这些方法,虽然性能差,但也比items方法好多了。并且支持优先级。

{k: v for d in dicts for k, v in d.items()}

python2.6中可以这样

dict((k, v) for d in dicts for k, v in d.items())

itertools.chain 将以正确的顺序将键值对上的迭代器链接:

import itertools
z = dict(itertools.chain(x.iteritems(), y.iteritems()))

性能测试

以下是在Ubuntu 14.04上完成的,在Python 2.7(系统Python)中:

>>> min(timeit.repeat(lambda: merge_two_dicts(x, y)))
0.5726828575134277
>>> min(timeit.repeat(lambda: {k: v for d in (x, y) for k, v in d.items()} ))
1.163769006729126
>>> min(timeit.repeat(lambda: dict(itertools.chain(x.iteritems(),y.iteritems()))))
1.1614501476287842
>>> min(timeit.repeat(lambda: dict((k, v) for d in (x, y) for k, v in d.items())))
2.2345519065856934

在python3.5中

>>> min(timeit.repeat(lambda: {**x, **y}))
0.4094954460160807
>>> min(timeit.repeat(lambda: merge_two_dicts(x, y)))
0.7881555100320838
>>> min(timeit.repeat(lambda: {k: v for d in (x, y) for k, v in d.items()} ))
1.4525277839857154
>>> min(timeit.repeat(lambda: dict(itertools.chain(x.items(), y.items()))))
2.3143140770262107
>>> min(timeit.repeat(lambda: dict((k, v) for d in (x, y) for k, v in d.items())))
3.2069112799945287

总结

以上就是这篇文章的全部内容了,希望本文的内容对大家的学习或者工作能带来一定的帮助,如果有疑问大家可以留言交流,谢谢大家对三水点靠木的支持。

Python 相关文章推荐
关于Django外键赋值问题详解
Aug 13 Python
python如何对实例属性进行类型检查
Mar 20 Python
用Python一键搭建Http服务器的方法
Jun 01 Python
PyQt5实现五子棋游戏(人机对弈)
Mar 24 Python
基于Python的PIL库学习详解
May 10 Python
Python 二叉树的层序建立与三种遍历实现详解
Jul 29 Python
Tensorflow--取tensorf指定列的操作方式
Jun 30 Python
python3将变量输入的简单实例
Aug 19 Python
Pycharm安装Qt Design快捷工具的详细教程
Nov 18 Python
详解Python之Scrapy爬虫教程NBA球员数据存放到Mysql数据库
Jan 24 Python
python中print格式化输出的问题
Apr 16 Python
浅谈pytorch中stack和cat的及to_tensor的坑
May 20 Python
Python中使用多进程来实现并行处理的方法小结
Aug 09 #Python
Python基于matplotlib绘制栈式直方图的方法示例
Aug 09 #Python
Python2.7编程中SQLite3基本操作方法示例
Aug 09 #Python
Django 前后台的数据传递的方法
Aug 08 #Python
关于python pyqt5安装失败问题的解决方法
Aug 08 #Python
利用Python自带PIL库扩展图片大小给图片加文字描述的方法示例
Aug 08 #Python
利用python打印出菱形、三角形以及矩形的方法实例
Aug 08 #Python
You might like
php expects parameter 1 to be resource, array given 错误
2011/03/23 PHP
php下载文件源代码(强制任意文件格式下载)
2014/05/09 PHP
PHP处理JSON字符串key缺少双引号的解决方法
2014/09/16 PHP
PHP会话处理的10个函数
2015/08/11 PHP
jquery动态改变onclick属性导致失效的问题解决方法
2013/12/04 Javascript
JavaScript变量声明详解
2014/11/27 Javascript
Bootstrap导航条可点击和鼠标悬停显示下拉菜单
2016/11/25 Javascript
js, jQuery实现全选、反选功能
2017/03/08 Javascript
canvas实现弧形可拖动进度条效果
2017/05/11 Javascript
BootStrap 页签切换失效的解决方法
2017/08/17 Javascript
Vue2.0 给Tab标签页和页面切换过渡添加样式的方法
2018/03/13 Javascript
探索JavaScript中私有成员的相关知识
2019/06/13 Javascript
vue调用本地摄像头实现拍照功能
2020/08/14 Javascript
[57:53]Secret vs Pain 2018国际邀请赛小组赛BO2 第二场 8.17
2018/08/20 DOTA
Django框架中的对象列表视图使用示例
2015/07/21 Python
python3爬取各类天气信息
2018/02/24 Python
Python hashlib模块实例使用详解
2019/12/24 Python
Python turtle库的画笔控制说明
2020/06/28 Python
Matlab中plot基本用法的具体使用
2020/07/17 Python
HTML5实现签到 功能
2018/10/09 HTML / CSS
澳大利亚在线床零售商:Bedworks
2020/09/01 全球购物
一道输出判断型Java面试题
2014/10/01 面试题
自荐信结尾
2013/10/27 职场文书
材料物理专业个人求职信
2013/12/15 职场文书
社区活动邀请函范文
2014/01/29 职场文书
学生干部学习的自我评价
2014/02/18 职场文书
机械制造毕业生求职信
2014/03/03 职场文书
学雷锋月活动总结
2014/04/25 职场文书
教师竞聘演讲稿
2014/05/16 职场文书
环境日宣传活动总结
2014/07/09 职场文书
幼儿园教师节演讲稿
2014/09/03 职场文书
2014年德育工作总结
2014/11/20 职场文书
汽车转让协议书范本
2014/12/07 职场文书
毕业典礼邀请函
2015/01/31 职场文书
元旦晚会主持词开场白
2015/05/28 职场文书
投诉信回复范文
2015/07/03 职场文书