Question

假设我有一个csv.DictReader对象，我想把它写成CSV文件。我怎么能这样做？

我知道我可以像这样编写数据行：

dr = csv.DictReader(open(f), delimiter='\t')
# process my dr object
# ...
# write out object
output = csv.DictWriter(open(f2, 'w'), delimiter='\t')
for item in dr:
    output.writerow(item)

但是我如何包含字段名？

Answer 1

编辑：
在2.7 / 3.2中有a new writeheader() method。此外，John Machin的回答提供了一种更简单的方法来编写标题行使用2.7 / 3.2中现有的writeheader()方法的简单示例：

from collections import OrderedDict
ordered_fieldnames = OrderedDict([('field1',None),('field2',None)])
with open(outfile,'wb') as fou:
    dw = csv.DictWriter(fou, delimiter='\t', fieldnames=ordered_fieldnames)
    dw.writeheader()
    # continue on to write data

实例化DictWriter需要一个fieldnames参数来自the documentation：

fieldnames参数标识中的值的顺序字典传递给了writerow（）方法被写入csvfile。

换句话说：Fieldnames参数是必需的，因为Python dicts本质上是无序的下面是如何将标题和数据写入文件的示例注意：在{2.6}中添加了with语句。如果使用2.5：from __future__ import with_statement

with open(infile,'rb') as fin:
    dr = csv.DictReader(fin, delimiter='\t')

# dr.fieldnames contains values from first row of `f`.
with open(outfile,'wb') as fou:
    dw = csv.DictWriter(fou, delimiter='\t', fieldnames=dr.fieldnames)
    headers = {} 
    for n in dw.fieldnames:
        headers[n] = n
    dw.writerow(headers)
    for row in dr:
        dw.writerow(row)

正如@FM在评论中提到的那样，你可以将标题写入浓缩，例如：

with open(outfile,'wb') as fou:
    dw = csv.DictWriter(fou, delimiter='\t', fieldnames=dr.fieldnames)
    dw.writerow(dict((fn,fn) for fn in dr.fieldnames))
    for row in dr:
        dw.writerow(row)

Answer 2

一些选择：

（1）费力地在你的字段名中制作一个身份映射（即无所事事）字典，以便csv.DictWriter可以将其转换回列表并将其传递给csv.writer实例。

（2）文档提到“基础writer实例”......所以只需使用它（最后的例子）。

dw.writer.writerow(dw.fieldnames)

（3）避免csv.Dictwriter开销并使用csv.writer自行完成

写数据：

w.writerow([d[k] for k in fieldnames])

或

w.writerow([d.get(k, restval) for k in fieldnames])

而不是extrasaction“功能”，我宁愿自己编写代码;这样你可以用键和值报告所有“额外”，而不仅仅是第一个额外的键。 DictWriter真正令人讨厌的是，如果你在构建每个dict时自己验证了密钥，你需要记住使用extrasaction ='ignore'否则它会慢慢（fieldnames是一个列表）重复检查：

wrong_fields = [k for k in rowdict if k not in self.fieldnames]

============

>>> f = open('csvtest.csv', 'wb')
>>> import csv
>>> fns = 'foo bar zot'.split()
>>> dw = csv.DictWriter(f, fns, restval='Huh?')
# dw.writefieldnames(fns) -- no such animal
>>> dw.writerow(fns) # no such luck, it can't imagine what to do with a list
Traceback (most recent call last):
  File "<stdin>", line 1, in <module>
  File "C:\python26\lib\csv.py", line 144, in writerow
    return self.writer.writerow(self._dict_to_list(rowdict))
  File "C:\python26\lib\csv.py", line 141, in _dict_to_list
    return [rowdict.get(key, self.restval) for key in self.fieldnames]
AttributeError: 'list' object has no attribute 'get'
>>> dir(dw)
['__doc__', '__init__', '__module__', '_dict_to_list', 'extrasaction', 'fieldnam
es', 'restval', 'writer', 'writerow', 'writerows']
# eureka
>>> dw.writer.writerow(dw.fieldnames)
>>> dw.writerow({'foo':'oof'})
>>> f.close()
>>> open('csvtest.csv', 'rb').read()
'foo,bar,zot\r\noof,Huh?,Huh?\r\n'
>>>

Answer 3

另一种方法是在输出中添加行之前添加，如下所示：

output.writerow(dict(zip(dr.fieldnames, dr.fieldnames)))

zip会返回包含相同值的doublet列表。此列表可用于启动字典。

如何用csv.DictWriter编写标题行？

3 个答案: