用Python打开远程文档

时间:2010-01-19 06:39:19

标签: python xml parsing document

from xml.dom.minidom import parse, parseString

datasource = open('http://www.ecb.europa.eu/stats/eurofxref/eurofxref-daily.xml')
dom = parse(datasource)

print dom

...上面的代码抛出IOError: 2, 'No such file or directory'。 Python不像PHP一样读取远程文档?我需要更改代码以使其读取XML文件?

由于

5 个答案:

答案 0 :(得分:4)

使用urllib2.urlopen()

>>> import urllib2
>>> from xml.dom.minidom import parse, parseString
>>> u1=urllib2.urlopen('http://www.ecb.europa.eu/stats/eurofxref/eurofxref-daily.xml')
>>> dom=parse(u1)
>>> print dom
<xml.dom.minidom.Document instance at 0x017D73A0>
>>> dom.childNodes
[<DOM Element: gesmes:Envelope at 0x17d7c88>]
>>> dom.childNodes[0].childNodes
[<DOM Text node "u'\n\t'">, <DOM Element: gesmes:subject at 0x1041aa8>,
 <DOM Text node "u'\n\t'">, <DOM Element: gesmes:Sender at 0xff8260>,
 <DOM Text node "u'\n\t'">, <DOM Element: Cube at 0x17d3dc8>, <DOM Text node "u'\n'">]
>>> 

此XML使用Cube标记用于太多构造,因此选择货币会有点令人兴奋。

>>> [elem.attributes['currency'].value for elem in
     dom.getElementsByTagName('Cube') if elem.hasAttribute('currency')]
[u'USD', u'JPY', u'BGN', u'CZK', u'DKK', u'EEK', u'GBP', u'HUF', u'LTL', u'LVL',
 u'PLN', u'RON', u'SEK', u'CHF', u'NOK', u'HRK', u'RUB', u'TRY', u'AUD', u'BRL',
 u'CAD', u'CNY', u'HKD', u'IDR', u'INR', u'KRW', u'MXN', u'MYR', u'NZD', u'PHP',
 u'SGD', u'THB', u'ZAR']
>>> 

答案 1 :(得分:1)

open用于在本地文件系统上打开文件。它无法打开网址。您必须使用urllib.urlopen返回支持API子集的对象等文件。

答案 2 :(得分:0)

使用urllib.urlopen()

答案 3 :(得分:0)

urllib.urlopen()方法返回File Object。因此,您可以直接将其传递给parse()方法

答案 4 :(得分:0)

    import urllib.request
    from xml.dom import minidom

    response = urllib.request.urlopen('http://www.ecb.europa.eu/stats/eurofxref/eurofxref-daily.xml')
    results = response.read()

    #print(results)     


    xmldoc = minidom.parseString(results)
    itemlist = xmldoc.getElementsByTagName('Cube') 
    # if itemlist[1].hasAttribute('time'): 
    #     print("Yes it has")
    # for s in itemlist[2].attributes.values():
    #     print(s.value)     
    #     print(itemlist[2].attributes.values())

    for s in itemlist:
        if s.hasAttribute('currency'):
            print(s.attributes['currency'].value + ' ' + s.attributes['rate'].value)
        else:
            pass