python set集合

一、集合简介  

  set集合是python的⼀个基本数据类型. ⼀般不是很常⽤. set中的元素是不重复的.⽆序的.⾥⾯的元素必须是hash(int, str, tuple,bool),

我们可以这样来记. set就是dict类型的数据但是不保存value, 只保存key. set也⽤{}表⽰ 。

  注意: set集合中的元素必须是可hash, 但是set本⾝是不可hash. set是可变的.

set1 = {'1','alex',2,True,[1,2,3]} # 报错 列表不可hash
set2 = {'1','alex',2,True,{1:2}} # 报错  字典不可hash
set3 = {'1','alex',2,True,(1,2,[2,3,4])} # 报错  元组中存在不可hash元素

  set 中的元素是不重复的,且底层是无序

s = {"周杰伦", "周杰伦", "周星星"}
print(s)#{'周星星', '周杰伦'} 去重

二、set 集合的增

  1、s.add("元素" )  表示在s集合中添加一个元素 ,不能添加重复元素

s = {"刘嘉玲", '关之琳', "王祖贤"}
s.add("郑裕玲")
print(s)#{'刘嘉玲', '王祖贤', '郑裕玲', '关之琳'}

  2、s.update("可迭代对象") 迭代添加,无序的

s = {"刘嘉玲", '关之琳', "王祖贤"}
s.update("123") # 迭代更新 
# {'刘嘉玲', '1', '3', '王祖贤', '2', '关之琳'}、{'3', '王祖贤', '关之琳', '1', '刘嘉玲', '2'}
s = {"刘嘉玲", '关之琳', "王祖贤"}
s.update(["MM","GG","XX"]) # 迭代更新
print(s)#{'XX', '王祖贤', 'MM', 'GG', '关之琳', '刘嘉玲'}

三、set集合的删

  1、s.pop( )  随机弹出一个

s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
item = s.pop() # 随机弹出⼀个.
print(s) #{'张曼⽟', '李若彤', '王祖贤', '关之琳'}
print(item) #

  2、s.remove("元素") 指定删除某元素

s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
s.remove("张曼⽟")
print(s) #{'刘嘉玲', '李若彤', '王祖贤', '关之琳'}

  3、s.clear( )  清空集合

s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
s.clear()
print(s) #set()

四、set集合的修改

  集合没有索引,也没有key,因此没法定位到元素的位置,集合的修改采取的修改方式分两步:

    1、删除需要修改的元素;

    2、新增元素  

#set集合中的数据没有索引. 也没有办法去定位⼀个元素. 所以没有办法进⾏直接修改.
# 我们可以采⽤先删除后添加的⽅式来完成修改操作
s = {"刘嘉玲", '关之琳', "王祖贤","张曼⽟", "李若彤"}
# 把刘嘉玲改成赵本⼭
s.remove("刘嘉玲")
s.add("赵本⼭")
print(s)

五、set集合的查

  遍历:for el in s: print(el) 

s={"哈哈","GG","呵呵","MM","嘻嘻"}
for el in s :
    print(el)

六、常用操作

s1 = {"刘能", "赵四", "⽪⻓⼭"}
s2 = {"刘科⻓", "冯乡⻓", "⽪⻓⼭"}
# 交集
# 两个集合中的共有元素
print(s1 & s2) # {'⽪⻓⼭'}
print(s1.intersection(s2)) # {'⽪⻓⼭'}
# 并集
print(s1 | s2) # {'刘科⻓', '冯乡⻓', '赵四', '⽪⻓⼭', '刘能'}
print(s1.union(s2)) # {'刘科⻓', '冯乡⻓', '赵四', '⽪⻓⼭', '刘能'}
# 差集
print(s1 - s2) # {'赵四', '刘能'} 得到第⼀个中单独存在的
print(s1.difference(s2)) # {'赵四', '刘能'}
# 反交集
print(s1 ^ s2) # 两个集合中单独存在的数据 {'冯乡⻓', '刘能', '刘科⻓', '赵四'}
print(s1.symmetric_difference(s2)) # {'冯乡⻓', '刘能', '刘科⻓', '赵四'}
s1 = {"刘能", "赵四"}
s2 = {"刘能", "赵四", "⽪⻓⼭"}
# ⼦集
print(s1 < s2) # set1是set2的⼦集吗? True
print(s1.issubset(s2))
# 超集
print(s1 > s2) # set1是set2的超集吗? False
print(s1.issuperset(s2))

    set集合本⾝是可以发⽣改变的. 是不可hash. 我们可以使⽤frozenset来保存数据.frozenset是不可变的. 也就是⼀个可哈希的数据类型 。

s = frozenset(["赵本⼭", "刘能", "⽪⻓⼭", "⻓跪"])
dic = {s:'123'} # 可以正常使⽤了
print(dic)

七、去重

lst=["哈哈","嘻嘻","GG","MM","呵呵","MM","嘻嘻"]
s=set(lst)
print(s) #{'哈哈', '嘻嘻', 'GG', '呵呵', 'MM'}

原文地址:https://www.cnblogs.com/angle6-liu/p/9989928.html