set集合的特點

2021-09-02 22:36:07 字數 3764 閱讀 2484

python的set和其他語言類似, 是乙個無序不重複元素集, 基本功能包括關係測試和消除重複元素. 集合物件還支援union(聯合), intersection(交), difference(差)和sysmmetric difference(對稱差集)等數**算.

sets 支援 x in set, len(set),和 for x in set。作為乙個無序的集合,sets不記錄元素位置或者插入點。因此,sets不支援 indexing, slicing, 或其它類序列(sequence-like)的操作。

下面來點簡單的小例子說明把。

>>> x = set('spam')

>>> y = set(['h','a','m'])

>>> x, y

(set(['a', 'p', 's', 'm']), set(['a', 'h', 'm']))

再來些小應用。

>>> x & y # 交集

set(['a', 'm'])

>>> x | y # 並集

set(['a', 'p', 's', 'h', 'm'])

>>> x - y # 差集

set(['p', 's'])

怎麼去除海量列表裡重複元素,用hash來解決也行,只不過感覺在效能上不是很高,用set解決還是很不錯的,示例如下:

>>> a = [11,22,33,44,11,22]

>>> b = set(a)

>>> b

set([33, 11, 44, 22])

>>> c = [i for i in b]

>>> c

[33, 11, 44, 22]

很酷把,幾行就可以搞定。

1.8 集合

集合用於包含一組無序的物件。要建立集合,可使用set()函式並像下面這樣提供一系列的項:

s = set([3,5,9,10]) #建立乙個數值集合

t = set("hello") #建立乙個唯一字元的集合

#與列表和元組不同,集合是無序的,也無法通過數字進行索引。

#集合中的元素不能重複。

集合支援一系列標準操作,包括並集、交集、差集和對稱差集,例如:

a = t | s # t 和 s的並集

b = t & s # t 和 s的交集

c = t – s # 求差集(項在t中,但不在s中)

d = t ^ s # 對稱差集(項在t或s中,但不會同時出現在二者中)

基本操作:

t.add('x') # 新增一項

s.update([10,37,42]) # 在s中新增多項

使用remove()可以刪除一項:

t.remove('h')

len(s)

set 的長度

x in s

測試 x 是否是 s 的成員

x not in s

測試 x 是否不是 s 的成員

s.issubset(t)

s <= t

測試是否 s 中的每乙個元素都在 t 中

s.issuperset(t)

s >= t

測試是否 t 中的每乙個元素都在 s 中

s.union(t)

s | t

返回乙個新的 set 包含 s 和 t 中的每乙個元素

s.intersection(t)

s & t

返回乙個新的 set 包含 s 和 t 中的公共元素

s.difference(t)

s - t

返回乙個新的 set 包含 s 中有但是 t 中沒有的元素

s.symmetric_difference(t)

s ^ t

返回乙個新的 set 包含 s 和 t 中不重複的元素

s.copy()

返回 set 「s」的乙個淺複製

請注意:union(), intersection(), difference() 和 symmetric_difference() 的非運算子(non-operator,就是形如 s.union()這樣的)版本將會接受任何 iterable 作為引數。相反,它們的運算子版本(operator based counterparts)要求引數必須是 sets。這樣可以避免潛在的錯誤,如:為了更可讀而使用 set('abc') & 'cbs' 來替代 set('abc').intersection('cbs')。從 2.3.1 版本中做的更改:以前所有引數都必須是 sets。

另外,set 和 immutableset 兩者都支援 set 與 set 之間的比較。兩個 sets 在也只有在這種情況下是相等的:每乙個 set 中的元素都是另乙個中的元素(二者互為subset)。乙個 set 比另乙個 set 小,只有在第乙個 set 是第二個 set 的 subset 時(是乙個 subset,但是並不相等)。乙個 set 比另乙個 set 打,只有在第乙個 set 是第二個 set 的 superset 時(是乙個 superset,但是並不相等)。

子 set 和相等比較並不產生完整的排序功能。例如:任意兩個 sets 都不相等也不互為子 set,因此以下的運算都會返回 false:ab。因此,sets 不提供 __cmp__ 方法。

因為 sets 只定義了部分排序功能(subset 關係),list.sort() 方法的輸出對於 sets 的列表沒有定義。

運算子

運算結果

hash(s)

返回 s 的 hash 值

下面這個表列出了對於 set 可用二對於 immutableset 不可用的運算:

運算子(voperator)

等價於運算結果

s.update(t)

s |= t

返回增加了 set 「t」中元素後的 set 「s」

s.intersection_update(t)

s &= t

返回只保留含有 set 「t」中元素的 set 「s」

s.difference_update(t)

s -= t

返回刪除了 set 「t」中含有的元素後的 set 「s」

s.symmetric_difference_update(t)

s ^= t

返回含有 set 「t」或者 set 「s」中有而不是兩者都有的元素的 set 「s」

s.add(x)

向 set 「s」中增加元素 x

s.remove(x)

從 set 「s」中刪除元素 x, 如果不存在則引發 keyerror

s.discard(x)

如果在 set 「s」中存在元素 x, 則刪除

s.pop()

刪除並且返回 set 「s」中的乙個不確定的元素, 如果為空則引發 keyerror

s.clear()

刪除 set 「s」中的所有元素

請注意:非運算子版本的 update(), intersection_update(), difference_update()和symmetric_difference_update()將會接受任意 iterable 作為引數。從 2.3.1 版本做的更改:以前所有引數都必須是 sets。

還請注意:這個模組還包含乙個 union_update() 方法,它是 update() 方法的乙個別名。包含這個方法是為了向後相容。程式設計師們應該多使用 update() 方法,因為這個方法也被內建的 set() 和 frozenset() 型別支援。

Java 基礎Set集合概述及特點

hashset 底層為hashmap。步驟 先看hashcode 值是否相同 相同 繼續走equals 方法 返回true 元素重複不新增 返回false 元素不重複新增 不同 就直接把元素新增到集合 如果類沒有重寫這兩個方法,預設使用object的方法,一般來說不相同.練習 需求 儲存自定義物件,...

集合的特點

1。set集合概述和特點 總結 set集合的特點 不允許儲存重複的元素 沒有索引 set集合的基本使用 new hashset 2.雜湊值 總結 雜湊值簡介 用於計算儲存元素的位置的.提高儲存元素和取出元素的效率的 如何獲取雜湊值 hashcode 雜湊值的特點 同乙個物件的雜湊值是一樣的 預設情況...

集合的特點

集合的特點 有的可變,有的不可變 元素無次序,不可重複。集合中的元素不能重複,可作為一種簡單高效的元素去重方式。集合沒有索引,它的元素無次序,不是序列。利用set 和 建立集合時,要求集合中的元素必須是可雜湊 hsshable 的,即在利用set 和 建立集合的時候,集合中的元素必須是不可變的。利用...