我有这个文件
10, 44.66.44.55 , AD, AC , 112
10, 44.66.54.55 , AD, AC , 112
10, 44.66.44.55 , AD, AC , 112
50, 44.66.64.55 , AD, AC , 112
10, 44.66.54.55 , AD, AC , 112
10, 44.66.44.55 , AD, AC , 112
我想添加具有相同IP地址的column1。我希望输出像
30, 44.66.44.55 , AD, AC , 112
20, 44.66.54.55 , AD, AC , 112
50, 44.66.64.55 , AD, AC , 112
我想在python
中做我试过
import re
import collections
a = collections.Counter()
with open("temp.txt", "r") as f:
for line in f.readlines():
list = line.split()
a[list[1]] += int(list[0])
print list[1]
答案 0 :(得分:1)
您可以使用itertools.groupby解决方案,这在这种情况下是理想的
>>> with open("test.csv") as fin:
grouped_lines = groupby(sorted((e.split(',') for e in fin), key = itemgetter(1)), key = itemgetter(1))
>>> for k, v in grouped_lines:
lines = list(v)
lines[0][0] = sum(int(e[0]) for e in lines)
print lines[0]
[30, ' 44.66.44.55 ', ' AD', ' AC ', ' 112\n']
[20, ' 44.66.54.55 ', ' AD', ' AC ', ' 112\n']
[50, ' 44.66.64.55 ', ' AD', ' AC ', ' 112\n']
答案 1 :(得分:1)
您需要在,
上拆分而不是在空格
试试这个
list = line.split(',')
答案 2 :(得分:0)
有一个collections.Counter
模块。它会返回{'word': numberTimes}
http://docs.python.org/2/library/collections.html
答案 3 :(得分:0)
虽然@ Abhijit的回答较短,但是 试试这个,它也有效。
处理完文件数据后,我将数据存储在字典中。然后在需要时操纵该数据 您的数据是字典中的值。
all_ips = {}
f = open('Test2.txt')
lines = f.readlines()
f.close()
for line in lines:
ip = line.split(',')[1]
props = line.split(',')
props[0] = int(props[0])
if ip not in all_ips:
all_ips[ip] = props
else:
all_ips[ip][0] += props[0]
for ip in all_ips:
print all_ips[ip]