python set集合

一、集合简介　　

　　set集合是python的⼀个基本数据类型. ⼀般不是很常⽤. set中的元素是不重复的.⽆序的.⾥⾯的元素必须是可hash的(int, str, tuple,bool),

我们可以这样来记. set就是dict类型的数据但是不保存value, 只保存key. set也⽤{}表⽰。

　　注意: set集合中的元素必须是可hash的, 但是set本⾝是不可hash得. set是可变的.

set1 = {'1','alex',2,True,[1,2,3]} # 报错 列表不可hash
set2 = {'1','alex',2,True,{1:2}} # 报错  字典不可hash
set3 = {'1','alex',2,True,(1,2,[2,3,4])} # 报错  元组中存在不可hash元素

　　set 中的元素是不重复的，且底层是无序

s = {"周杰伦", "周杰伦", "周星星"}
print(s)#{'周星星', '周杰伦'} 去重

二、set 集合的增

　　1、s.add("元素" )　　表示在s集合中添加一个元素，不能添加重复元素

s = {"刘嘉玲", '关之琳', "王祖贤"}
s.add("郑裕玲")
print(s)#{'刘嘉玲', '王祖贤', '郑裕玲', '关之琳'}

　　2、s.update("可迭代对象") 迭代添加，无序的

s = {"刘嘉玲", '关之琳', "王祖贤"}
s.update("123") # 迭代更新 
# {'刘嘉玲', '1', '3', '王祖贤', '2', '关之琳'}、{'3', '王祖贤', '关之琳', '1', '刘嘉玲', '2'}

s = {"刘嘉玲", '关之琳', "王祖贤"}
s.update(["MM","GG","XX"]) # 迭代更新
print(s)#{'XX', '王祖贤', 'MM', 'GG', '关之琳', '刘嘉玲'}

三、set集合的删

　　1、s.pop( ) 随机弹出一个

s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
item = s.pop() # 随机弹出⼀个.
print(s) #{'张曼⽟', '李若彤', '王祖贤', '关之琳'}
print(item) #

　　2、s.remove("元素") 指定删除某元素

s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
s.remove("张曼⽟")
print(s) #{'刘嘉玲', '李若彤', '王祖贤', '关之琳'}

　　3、s.clear( ) 　清空集合

s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
s.clear()
print(s) #set()

四、set集合的修改

　　集合没有索引，也没有key,因此没法定位到元素的位置，集合的修改采取的修改方式分两步：

　　　　1、删除需要修改的元素；

　　　　2、新增元素　　

#set集合中的数据没有索引. 也没有办法去定位⼀个元素. 所以没有办法进⾏直接修改.
# 我们可以采⽤先删除后添加的⽅式来完成修改操作
s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
# 把刘嘉玲改成赵本⼭
s.remove("刘嘉玲")
s.add("赵本⼭")
print(s)

五、set集合的查

　　遍历：for el in s: print(el)

s={"哈哈","GG","呵呵","MM","嘻嘻"}
for el in s :
    print(el)

六、常用操作

s1 = {"刘能", "赵四", "⽪⻓⼭"}
s2 = {"刘科⻓", "冯乡⻓", "⽪⻓⼭"}
# 交集
# 两个集合中的共有元素
print(s1 & s2) # {'⽪⻓⼭'}
print(s1.intersection(s2)) # {'⽪⻓⼭'}
# 并集
print(s1 | s2) # {'刘科⻓', '冯乡⻓', '赵四', '⽪⻓⼭', '刘能'}
print(s1.union(s2)) # {'刘科⻓', '冯乡⻓', '赵四', '⽪⻓⼭', '刘能'}
# 差集
print(s1 - s2) # {'赵四', '刘能'} 得到第⼀个中单独存在的
print(s1.difference(s2)) # {'赵四', '刘能'}
# 反交集
print(s1 ^ s2) # 两个集合中单独存在的数据 {'冯乡⻓', '刘能', '刘科⻓', '赵四'}
print(s1.symmetric_difference(s2)) # {'冯乡⻓', '刘能', '刘科⻓', '赵四'}
s1 = {"刘能", "赵四"}
s2 = {"刘能", "赵四", "⽪⻓⼭"}
# ⼦集
print(s1 < s2) # set1是set2的⼦集吗? True
print(s1.issubset(s2))
# 超集
print(s1 > s2) # set1是set2的超集吗? False
print(s1.issuperset(s2))

　 set集合本⾝是可以发⽣改变的. 是不可hash的. 我们可以使⽤frozenset来保存数据.frozenset是不可变的. 也就是⼀个可哈希的数据类型。

s = frozenset(["赵本⼭", "刘能", "⽪⻓⼭", "⻓跪"])
dic = {s:'123'} # 可以正常使⽤了
print(dic)

七、去重

lst=["哈哈","嘻嘻","GG","MM","呵呵","MM","嘻嘻"]
s=set(lst)
print(s) #{'哈哈', '嘻嘻', 'GG', '呵呵', 'MM'}