日本综合一区二区|亚洲中文天堂综合|日韩欧美自拍一区|男女精品天堂一区|欧美自拍第6页亚洲成人精品一区|亚洲黄色天堂一区二区成人|超碰91偷拍第一页|日韩av夜夜嗨中文字幕|久久蜜综合视频官网|精美人妻一区二区三区

RELATEED CONSULTING
相關咨詢
選擇下列產(chǎn)品馬上在線溝通
服務時間:8:30-17:00
你可能遇到了下面的問題
關閉右側工具欄

新聞中心

這里有您想知道的互聯(lián)網(wǎng)營銷解決方案
Python是如何處理垃圾的?

前言

語言的內(nèi)存管理是語言設計的一個重要方面。它是決定語言性能的重要因素。無論是C語言的手工管理,還是Java的垃圾回收,都成為語言最重要的特征。這里以Python語言為例子,說明一門動態(tài)類型的、面向對象的語言的內(nèi)存管理方式。 

為秀峰等地區(qū)用戶提供了全套網(wǎng)頁設計制作服務,及秀峰網(wǎng)站建設行業(yè)解決方案。主營業(yè)務為網(wǎng)站設計、網(wǎng)站制作、秀峰網(wǎng)站設計,以傳統(tǒng)方式定制建設網(wǎng)站,并提供域名空間備案等一條龍服務,秉承以專業(yè)、用心的態(tài)度為用戶提供真誠的服務。我們深信只要達到每一位用戶的要求,就會得到認可,從而選擇與我們長期合作。這樣,我們也可以走得更遠!

對象的內(nèi)存使用

賦值語句是語言最常見的功能了。但即使是最簡單的賦值語句,也可以很有內(nèi)涵。Python的賦值語句就很值得研究。 

 
 
 
 
  1. a = 1 

整數(shù)1為一個對象。而a是一個引用。利用賦值語句,引用a指向對象1。Python是動態(tài)類型的語言(參考動態(tài)類型),對象與引用分離。Python像使用“筷子”那樣,通過引用來接觸和翻動真正的食物——對象。

 引用和對象

為了探索對象在內(nèi)存的存儲,我們可以求助于Python的內(nèi)置函數(shù)id()。它用于返回對象的身份(identity)。其實,這里所謂的身份,就是該對象的內(nèi)存地址。 

 
 
 
 
  1. a = 1  
  2. print(id(a))  
  3. print(hex(id(a))) 

在我的計算機上,它們返回的是: 

 
 
 
 
  1. 11246696  
  2. '0xab9c68' 

分別為內(nèi)存地址的十進制和十六進制表示。

在Python中,整數(shù)和短小的字符,Python都會緩存這些對象,以便重復使用。當我們創(chuàng)建多個等于1的引用時,實際上是讓所有這些引用指向同一個對象。 

 
 
 
 
  1. a = 1  
  2. b = 1  
  3. print(id(a)) 
  4. print(id(b)) 

上面程序返回 

 
 
 
 
  1. 11246696  
  2. 11246696 

可見a和b實際上是指向同一個對象的兩個引用。

為了檢驗兩個引用指向同一個對象,我們可以用is關鍵字。is用于判斷兩個引用所指的對象是否相同。 

 
 
 
 
  1. # True  
  2. a = 1  
  3. b = 1  
  4. print(a is b)  
  5. # True  
  6. a = "good"  
  7. b = "good"  
  8. print(a is b)  
  9. # False  
  10. a = "very good morning"  
  11. b = "very good morning"  
  12. print(a is b)  
  13. # False  
  14. a = []  
  15. b = []  
  16. print(a is b) 

上面的注釋為相應的運行結果??梢钥吹?,由于Python緩存了整數(shù)和短字符串,因此每個對象只存有一份。比如,所有整數(shù)1的引用都指向同一對象。即使使用賦值語句,也只是創(chuàng)造了新的引用,而不是對象本身。長的字符串和其它對象可以有多個相同的對象,可以使用賦值語句創(chuàng)建出新的對象。

在Python中,每個對象都有存有指向該對象的引用總數(shù),即引用計數(shù)(reference count)。

我們可以使用sys包中的getrefcount(),來查看某個對象的引用計數(shù)。需要注意的是,當使用某個引用作為參數(shù),傳遞給getrefcount()時,參數(shù)實際上創(chuàng)建了一個臨時的引用。因此,getrefcount()所得到的結果,會比期望的多1。 

 
 
 
 
  1. from sys import getrefcount  
  2. a = [1, 2, 3]  
  3. print(getrefcount(a))  
  4. b = a  
  5. print(getrefcount(b)) 

由于上述原因,兩個getrefcount將返回2和3,而不是期望的1和2。 

對象引用對象

Python的一個容器對象(container),比如表、詞典等,可以包含多個對象。實際上,容器對象中包含的并不是元素對象本身,是指向各個元素對象的引用。

我們也可以自定義一個對象,并引用其它對象: 

 
 
 
 
  1. class from_obj(object):  
  2.     def __init__(self, to_obj):  
  3.         self.to_obj = to_obj  
  4. b = [1,2,3]  
  5. a = from_obj(b)  
  6. print(id(a.to_obj))  
  7. print(id(b)) 

可以看到,a引用了對象b。

對象引用對象,是Python最基本的構成方式。即使是a = 1這一賦值方式,實際上是讓詞典的一個鍵值"a"的元素引用整數(shù)對象1。該詞典對象用于記錄所有的全局引用。該詞典引用了整數(shù)對象1。我們可以通過內(nèi)置函數(shù)globals()來查看該詞典。

當一個對象A被另一個對象B引用時,A的引用計數(shù)將增加1。 

 
 
 
 
  1. from sys import getrefcount  
  2. a = [1, 2, 3]  
  3. print(getrefcount(a))  
  4. b = [a, a]  
  5. print(getrefcount(a)) 

由于對象b引用了兩次a,a的引用計數(shù)增加了2。

容器對象的引用可能構成很復雜的拓撲結構。我們可以用objgraph包來繪制其引用關系,比如 

 
 
 
 
  1. x = [1, 2, 3]  
  2. y = [x, dict(key1=x)]  
  3. z = [y, (x, y)]  
  4. import objgraph  
  5. objgraph.show_refs([z], filename='ref_topo.png') 

objgraph是Python的一個第三方包。安裝之前需要安裝xdot。 

 
 
 
 
  1. sudo apt-get install xdot  
  2. sudo pip install objgraph 

objgraph官網(wǎng):http://mg.pov.lt/objgraph/

兩個對象可能相互引用,從而構成所謂的引用環(huán)(reference cycle)。 

 
 
 
 
  1. a = []  
  2. b = [a]  
  3. a.append(b) 

即使是一個對象,只需要自己引用自己,也能構成引用環(huán)。 

 
 
 
 
  1. a = []  
  2. a.append(a)  
  3. print(getrefcount(a)) 

引用環(huán)會給垃圾回收機制帶來很大的麻煩,我將在后面詳細敘述這一點。 

引用減少

某個對象的引用計數(shù)可能減少。比如,可以使用del關鍵字刪除某個引用: 

 
 
 
 
  1. from sys import getrefcount  
  2. a = [1, 2, 3]  
  3. b = a  
  4. print(getrefcount(b))  
  5. del a  
  6. print(getrefcount(b))  

del也可以用于刪除容器元素中的元素,比如: 

 
 
 
 
  1. a = [1,2,3]  
  2. del a[0]  
  3. print(a) 

如果某個引用指向對象A,當這個引用被重新定向到某個其他對象B時,對象A的引用計數(shù)減少: 

 
 
 
 
  1. from sys import getrefcount  
  2. a = [1, 2, 3]  
  3. b = a  
  4. print(getrefcount(b))  
  5. a = 1  
  6. print(getrefcount(b))  

垃圾回收

吃太多,總會變胖,Python也是這樣。當Python中的對象越來越多,它們將占據(jù)越來越大的內(nèi)存。不過你不用太擔心Python的體形,它會乖巧的在適當?shù)臅r候“減肥”,啟動垃圾回收(garbage collection),將沒用的對象清除。在許多語言中都有垃圾回收機制,比如Java和Ruby。盡管最終目的都是塑造苗條的提醒,但不同語言的減肥方案有很大的差異 。

從基本原理上,當Python的某個對象的引用計數(shù)降為0時,說明沒有任何引用指向該對象,該對象就成為要被回收的垃圾了。比如某個新建對象,它被分配給某個引用,對象的引用計數(shù)變?yōu)?。如果引用被刪除,對象的引用計數(shù)為0,那么該對象就可以被垃圾回收。比如下面的表: 

 
 
 
 
  1. a = [1, 2, 3]  
  2. del a 

del a后,已經(jīng)沒有任何引用指向之前建立的[1, 2, 3]這個表。用戶不可能通過任何方式接觸或者動用這個對象。這個對象如果繼續(xù)待在內(nèi)存里,就成了不健康的脂肪。當垃圾回收啟動時,Python掃描到這個引用計數(shù)為0的對象,就將它所占據(jù)的內(nèi)存清空。

然而,減肥是個昂貴而費力的事情。垃圾回收時,Python不能進行其它的任務。頻繁的垃圾回收將大大降低Python的工作效率。如果內(nèi)存中的對象不多,就沒有必要總啟動垃圾回收。所以,Python只會在特定條件下,自動啟動垃圾回收。當Python運行時,會記錄其中分配對象(object allocation)和取消分配對象(object deallocation)的次數(shù)。當兩者的差值高于某個閾值時,垃圾回收才會啟動。

我們可以通過gc模塊的get_threshold()方法,查看該閾值: 

 
 
 
 
  1. import gc  
  2. print(gc.get_threshold()) 

返回(700, 10, 10),后面的兩個10是與分代回收相關的閾值,后面可以看到。700即是垃圾回收啟動的閾值??梢酝ㄟ^gc中的set_threshold()方法重新設置。

我們也可以手動啟動垃圾回收,即使用gc.collect()。 

分代回收

Python同時采用了分代(generation)回收的策略。這一策略的基本假設是,存活時間越久的對象,越不可能在后面的程序中變成垃圾。我們的程序往往會產(chǎn)生大量的對象,許多對象很快產(chǎn)生和消失,但也有一些對象長期被使用。出于信任和效率,對于這樣一些“長壽”對象,我們相信它們的用處,所以減少在垃圾回收中掃描它們的頻率。

小家伙要多檢查

Python將所有的對象分為0,1,2三代。所有的新建對象都是0代對象。當某一代對象經(jīng)歷過垃圾回收,依然存活,那么它就被歸入下一代對象。垃圾回收啟動時,一定會掃描所有的0代對象。如果0代經(jīng)過一定次數(shù)垃圾回收,那么就啟動對0代和1代的掃描清理。當1代也經(jīng)歷了一定次數(shù)的垃圾回收后,那么會啟動對0,1,2,即對所有對象進行掃描。

這兩個次數(shù)即上面get_threshold()返回的(700, 10, 10)返回的兩個10。也就是說,每10次0代垃圾回收,會配合1次1代的垃圾回收;而每10次1代的垃圾回收,才會有1次的2代垃圾回收。

同樣可以用set_threshold()來調(diào)整,比如對2代對象進行更頻繁的掃描。 

 
 
 
 
  1. import gc  
  2. gc.set_threshold(700, 10, 5) 

孤立的引用環(huán)

引用環(huán)的存在會給上面的垃圾回收機制帶來很大的困難。這些引用環(huán)可能構成無法使用,但引用計數(shù)不為0的一些對象。 

 
 
 
 
  1. a = []  
  2. b = [a]  
  3. a.append(b)  
  4. del a  
  5. del b 

上面我們先創(chuàng)建了兩個表對象,并引用對方,構成一個引用環(huán)。刪除了a,b引用之后,這兩個對象不可能再從程序中調(diào)用,就沒有什么用處了。但是由于引用環(huán)的存在,這兩個對象的引用計數(shù)都沒有降到0,不會被垃圾回收。

孤立的引用環(huán)

為了回收這樣的引用環(huán),Python復制每個對象的引用計數(shù),可以記為gc_ref。假設,每個對象i,該計數(shù)為gc_ref_i。Python會遍歷所有的對象i。對于每個對象i引用的對象j,將相應的gc_ref_j減1。

 遍歷后的結果

在結束遍歷后,gc_ref不為0的對象,和這些對象引用的對象,以及繼續(xù)更下游引用的對象,需要被保留。而其它的對象則被垃圾回收。 

總結

Python作為一種動態(tài)類型的語言,其對象和引用分離。這與曾經(jīng)的面向過程語言有很大的區(qū)別。為了有效的釋放內(nèi)存,Python內(nèi)置了垃圾回收的支持。Python采取了一種相對簡單的垃圾回收機制,即引用計數(shù),并因此需要解決孤立引用環(huán)的問題。Python與其它語言既有共通性,又有特別的地方。對該內(nèi)存管理機制的理解,是提高Python性能的重要一步。 


文章名稱:Python是如何處理垃圾的?
文章起源:http://www.dlmjj.cn/article/coeoceh.html