一、集合简介
set集合是python的⼀个基本数据类型. ⼀般不是很常⽤. set中的元素是不重复的.⽆序的.⾥⾯的元素必须是可hash的(int, str, tuple,bool),
我们可以这样来记. set就是dict类型的数据但是不保存value, 只保存key. set也⽤{}表⽰ 。
注意: set集合中的元素必须是可hash的, 但是set本⾝是不可hash得. set是可变的.
set1 = {'1','alex',2,True,[1,2,3]} # 报错 列表不可hash set2 = {'1','alex',2,True,{1:2}} # 报错 字典不可hash set3 = {'1','alex',2,True,(1,2,[2,3,4])} # 报错 元组中存在不可hash元素
set 中的元素是不重复的,且底层是无序
s = {"周杰伦", "周杰伦", "周星星"} print(s)#{'周星星', '周杰伦'} 去重
二、set 集合的增
1、s.add("元素" ) 表示在s集合中添加一个元素 ,不能添加重复元素
s = {"刘嘉玲", '关之琳', "王祖贤"} s.add("郑裕玲") print(s)#{'刘嘉玲', '王祖贤', '郑裕玲', '关之琳'}
2、s.update("可迭代对象") 迭代添加,无序的
s = {"刘嘉玲", '关之琳', "王祖贤"} s.update("123") # 迭代更新 # {'刘嘉玲', '1', '3', '王祖贤', '2', '关之琳'}、{'3', '王祖贤', '关之琳', '1', '刘嘉玲', '2'}
s = {"刘嘉玲", '关之琳', "王祖贤"} s.update(["MM","GG","XX"]) # 迭代更新 print(s)#{'XX', '王祖贤', 'MM', 'GG', '关之琳', '刘嘉玲'}
三、set集合的删
1、s.pop( ) 随机弹出一个
s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"} item = s.pop() # 随机弹出⼀个. print(s) #{'张曼⽟', '李若彤', '王祖贤', '关之琳'} print(item) #
2、s.remove("元素") 指定删除某元素
s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"} s.remove("张曼⽟") print(s) #{'刘嘉玲', '李若彤', '王祖贤', '关之琳'}
3、s.clear( ) 清空集合
s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"} s.clear() print(s) #set()
四、set集合的修改
集合没有索引,也没有key,因此没法定位到元素的位置,集合的修改采取的修改方式分两步:
1、删除需要修改的元素;
2、新增元素
#set集合中的数据没有索引. 也没有办法去定位⼀个元素. 所以没有办法进⾏直接修改. # 我们可以采⽤先删除后添加的⽅式来完成修改操作 s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"} # 把刘嘉玲改成赵本⼭ s.remove("刘嘉玲") s.add("赵本⼭") print(s)
五、set集合的查
遍历:for el in s: print(el)
s={"哈哈","GG","呵呵","MM","嘻嘻"} for el in s : print(el)
六、常用操作
s1 = {"刘能", "赵四", "⽪⻓⼭"} s2 = {"刘科⻓", "冯乡⻓", "⽪⻓⼭"} # 交集 # 两个集合中的共有元素 print(s1 & s2) # {'⽪⻓⼭'} print(s1.intersection(s2)) # {'⽪⻓⼭'} # 并集 print(s1 | s2) # {'刘科⻓', '冯乡⻓', '赵四', '⽪⻓⼭', '刘能'} print(s1.union(s2)) # {'刘科⻓', '冯乡⻓', '赵四', '⽪⻓⼭', '刘能'} # 差集 print(s1 - s2) # {'赵四', '刘能'} 得到第⼀个中单独存在的 print(s1.difference(s2)) # {'赵四', '刘能'} # 反交集 print(s1 ^ s2) # 两个集合中单独存在的数据 {'冯乡⻓', '刘能', '刘科⻓', '赵四'} print(s1.symmetric_difference(s2)) # {'冯乡⻓', '刘能', '刘科⻓', '赵四'} s1 = {"刘能", "赵四"} s2 = {"刘能", "赵四", "⽪⻓⼭"} # ⼦集 print(s1 < s2) # set1是set2的⼦集吗? True print(s1.issubset(s2)) # 超集 print(s1 > s2) # set1是set2的超集吗? False print(s1.issuperset(s2))
set集合本⾝是可以发⽣改变的. 是不可hash的. 我们可以使⽤frozenset来保存数据.frozenset是不可变的. 也就是⼀个可哈希的数据类型 。
s = frozenset(["赵本⼭", "刘能", "⽪⻓⼭", "⻓跪"]) dic = {s:'123'} # 可以正常使⽤了 print(dic)
七、去重
lst=["哈哈","嘻嘻","GG","MM","呵呵","MM","嘻嘻"] s=set(lst) print(s) #{'哈哈', '嘻嘻', 'GG', '呵呵', 'MM'}