新聞中心
這里有您想知道的互聯(lián)網(wǎng)營銷解決方案
[XPath]XPath與lxml(二)XPath語法-創(chuàng)新互聯(lián)
XPath 選取節(jié)點時使用的表達(dá)式是一種路徑表達(dá)式。節(jié)點是通過路徑(path)或者步(steps)來選取的。![[XPath]XPath與lxm
l(二)XPath語法 [XPath]XPath與lxm
l(二)XPath語法](/upload/otherpic3/2167342.jpg)
分享文章:[XPath]XPath與lxml(二)XPath語法-創(chuàng)新互聯(lián)
文章分享:http://www.dlmjj.cn/article/ccodic.html
![[XPath]XPath與lxm
l(二)XPath語法 [XPath]XPath與lxm
l(二)XPath語法](/upload/otherpic3/2167342.jpg)
本章使用以下 XML 文檔作為示例。
Harry Potter 29.99 Learning XML 39.95
選取節(jié)點以下為基本路徑的表達(dá)方式,記住 XPath 的路徑表達(dá)式都是基于某個節(jié)點之上的,例如最初的當(dāng)前節(jié)點一般是根節(jié)點,這與 Linux 下路徑切換原理是一樣的。
表達(dá)式 | 描述 |
nodename | 選取已匹配節(jié)點下名為 nodename 的子元素節(jié)點。 |
/ | 如果以 / 開頭,表示從根節(jié)點作為選取起點。 |
// | 在已匹配節(jié)點后代中選取節(jié)點,不考慮目標(biāo)節(jié)點的位置。 |
. | 選取當(dāng)前節(jié)點。 |
.. | 選取當(dāng)前節(jié)點的父元素節(jié)點。 |
@ | 選取屬性。 |
>>> from lxml import etree
>>> xml = """
Harry Potter
29.99
Learning XML
39.95
"""# 得到根節(jié)點>>> root = etree.fromstring(xml)
>>> print root
# 選取所有book子元素>>> root.xpath('book')
[, ]
# 選取根節(jié)點bookstore>>> root.xpath('/bookstore')
[]
# 選取所有book子元素的title子元素>>> root.xpath('book/title')
[, ]
# 以根節(jié)點為始祖,選取其后代中的title元素>>> root.xpath('//title')
[, ]
# 以book子元素為始祖,選取后代中的price元素>>> root.xpath('book//price')
[, ]
# 以根節(jié)點為始祖,選取其后代中的lang屬性值>>> root.xpath('//@lang')
['eng', 'eng']
預(yù)判(Predicates)預(yù)判是用來查找某個特定的節(jié)點或者符合某種條件的節(jié)點,預(yù)判表達(dá)式位于方括號中。
# 選取bookstore的第一個book子元素>>> root.xpath('/bookstore/book[1]')
[]
# 選取bookstore的最后一個book子元素>>> root.xpath('/bookstore/book[last()]')
[]
# 選取bookstore的倒數(shù)第二個book子元素>>> root.xpath('/bookstore/book[last()-1]')
[]
# 選取bookstore的前兩個book子元素>>> root.xpath('/bookstore/book[position()<3]')
[, ]
# 以根節(jié)點為始祖,選取其后代中含有l(wèi)ang屬性的title元素>>> root.xpath('//title[@lang]')
[, ]
# 以根節(jié)點為始祖,選取其后代中含有l(wèi)ang屬性并且值為eng的title元素>>> root.xpath("http://title[@lang='eng']")
[, ]
# 選取bookstore子元素book,條件是book的price子元素要大于35>>> root.xpath("/bookstore/book[price>35.00]")
[]
# 選取bookstore子元素book的子元素title,條件是book的price子元素要大于35>>> root.xpath("/bookstore/book[price>35.00]/title")
[]
通配符
通配符 | 描述 |
* | 匹配任何元素。 |
@* | 匹配任何屬性。 |
node() | 匹配任何類型的節(jié)點。 |
# 選取 bookstore 所有子元素>>> root.xpath('/bookstore/*')
[, ]
# 選取根節(jié)點的所有后代元素>>> root.xpath('//*')
[, , , , , , ]
# 選取根節(jié)點的所有具有屬性節(jié)點的title元素>>> root.xpath('//title[@*]')
[, ]
# 選取當(dāng)前節(jié)點下所有節(jié)點。'
' 是文本節(jié)點。>>> root.xpath('node()')
['
', , '
', , '
']
# 選取根節(jié)點所有后代節(jié)點,包括元素、屬性、文本。>>> root.xpath('//node()')
[, '
', , '
', , 'Harry Potter', '
', , '29.99', '
', '
', , '
', , 'Learning XML', '
', , '39.95', '
', '
']
或條件選取使用 "|" 運算符,你可以選取符合“或”條件的若干路徑。
# 選取所有book的title元素或者price元素>>> root.xpath('//book/title|//book/price')
[, , , ]
# 選擇所有title或者price元素>>> root.xpath('//title|//price')
[, , , ]
# 選擇book子元素title或者全部的price元素>>> root.xpath('/bookstore/book/title|//price')
[, , , ]
分享文章:[XPath]XPath與lxml(二)XPath語法-創(chuàng)新互聯(lián)
文章分享:http://www.dlmjj.cn/article/ccodic.html