Stack Overflow上有一些类似的主题,但我找不到任何实际解释如何操作的主题。
我有一个API,它将数据作为XML
返回。我想将其转换为JSON
,因为我将其存储在MongoDB
。
<cj-api>
<products total-matched="231746" records-returned="999" page-number="1">
<product>
<ad-id>10648829</ad-id>
<advertiser-id>2618386</advertiser-id>
<advertiser-name>Acne Jeans UK</advertiser-name>
<advertiser-category>New Arrivals</advertiser-category>
<buy-url>http://www.tkqlhce.com/click-7227532-10648829?url=http%3A%2F%2Fshop.acnestudios.com%2Fpop-cord-white.html&cjsku=30X133-151</buy-url>
<catalog-id>cjo:939</catalog-id>
<currency>EUR</currency>
<description>Pop Cord White.</description>
<image-url>http://c893323.r23.cf3.rackcdn.com/catalog/product/cache/25/thumbnail/300x300/9df78eab33525d08d6e5fb8d27136e95/3/0/30X133-151_A_57419.jpg</image-url>
<in-stock>true</in-stock>
<isbn/>
<manufacturer-name>Acne Studios</manufacturer-name>
<manufacturer-sku/>
<name>Pop Cord White</name>
<price>200.0</price>
<retail-price/>
<sale-price/>
<sku>30X133-151</sku>
<upc/>
</product>
<product>
<ad-id>10648829</ad-id>
<advertiser-id>2618386</advertiser-id>
<advertiser-name>Acne Jeans UK</advertiser-name>
<advertiser-category>Jeans</advertiser-category>
<buy-url>http://www.dpbolvw.net/click-7227532-10648829?url=http%3A%2F%2Fshop.acnestudios.com%2Fflex-black.html&cjsku=30H126-129</buy-url>
<catalog-id>cjo:939</catalog-id>
<currency>EUR</currency>
<description>Acne Flex Black jeans are narrow, tight fitting jeans with a comfortable mid rise waist.<ul>
<li>Worn in black blue wash</li>
<li>Classic five pocket styling</li>
<li>Zippered fly front closure</li>
<li>Secures at the waist with bachelor button</li>
<li>Acne embossed rivets</li>
</ul>.</description>
<image-url>http://c893323.r23.cf3.rackcdn.com/catalog/product/cache/25/thumbnail/300x300/9df78eab33525d08d6e5fb8d27136e95/3/0/30H126-129_A_18.jpg</image-url>
<in-stock>true</in-stock>
<isbn/>
<manufacturer-name>Acne Studios</manufacturer-name>
<manufacturer-sku/>
<name>Flex Black</name>
<price>170.0</price>
<retail-price/>
<sale-price/>
<sku>30H126-129</sku>
<upc/>
</product>
</products>
</cj-api>
(假设只有2个产品 - 实际上有231,746个!)
在Node中,我使用request
来收集此XML并将其存储在名为body
的变量中。我正在使用libxmljs
,如下所示:
var xmlDoc = libxmljs.parseXmlString(body);
var product = xmlDoc.get('//product'); <!-- very unsure whether I'm using this correctly
问题是我完全不知道如何处理这些数据,而libxmljs docs在这方面确实无益。我想做一些与jQuery相同的东西:
$('product').each(function(){
var obj = {
advertiser-name: $(this).find('advertiser-name'),
buy-url: $(this).find('buy-url'),
... etc etc etc
})
如何使用libxmljs
/其他库来执行此操作,以便我可以更轻松地处理数据?
答案 0 :(得分:4)
关于使用libxmljs
:
您需要使用xmlDoc.find('//product')
而不是get
,因为get
仅返回特定XPath的第一个元素(//product
是XPath) 。您可以在wiki
方法find
返回elements的数组,因此等效于您的jQuery示例:
var xmlDoc = libxmljs.parseXmlString(xml);
var products = xmlDoc.find('//product');
for (var index = 0; index < products.length; index++) {
var obj = {
"advertiser-name": products[index].get('advertiser-name').text()
};
// ...
}
在每个元素的这个例子中,我使用方法get
(因为我知道只有一个孩子有这个名字)来获取子元素,然后只需要询问此元素的text
值。
第二,我想推荐你xml2js
模块(github),它可以将xml转换为JSON对象。为此,您只需要使用parseString
函数和两个参数xml
string和callback function (err, result) { ... }
,其中result将是此xml的JSON表示形式。
因为你还提到每个xml都可以有&gt; 200,000种产品 - 您需要了解这些库的性能。在我看来,它们都将在内存中加载整个XML。如果你只需要执行一次这个脚本,或者每天(或每小时)执行一次 - 我想可以按原样使用它。如果您需要提高性能,请查看libxmljs
库中的SaxPushParser界面。