我有一个包含n行(以逗号分隔)和列的文本文件,我想查找每列的平均值,不包括空字段。
示例输入如下:
1,2,3
4,,6
,7,
所需的输出是:
2.5, 4.5, 4.5
我试过
awk -F',' '{ for(i=1;i<=NF;i++) sum[i]=sum[i]+$i;if(max < NF)max=NF;};END { for(j=1;j<=max;j++) printf "%d\t",sum[j]/max;}' input
但它将连续分隔符视为一个并将列混合。 非常感谢任何帮助。
答案 0 :(得分:5)
你可以使用这个单行:
$ awk -F, '{for(i=1; i<=NF; i++) {a[i]+=$i; if($i!="") b[i]++}}; END {for(i=1; i<=NF; i++) printf "%s%s", a[i]/b[i], (i==NF?ORS:OFS)}' foo
2.5 4.5 4.5
否则,您可以将其保存在文件script.awk
中并运行awk -f script.awk your_file
:
{
for(i=1; i<=NF; i++) {
a[i]+=$i
if($i!="")
b[i]++}
}
END {
for(i=1; i<=NF; i++)
printf "%s%s", a[i]/b[i], (i==NF?ORS:OFS)
}