awk文件中每列的平均值

时间:2016-08-24 11:08:07

标签: awk average delimiter comma

我有一个包含n行(以逗号分隔)和列的文本文件,我想查找每列的平均值,不包括空字段。

示例输入如下:

1,2,3
4,,6
,7,

所需的输出是:

2.5, 4.5, 4.5

我试过

awk -F',' '{ for(i=1;i<=NF;i++) sum[i]=sum[i]+$i;if(max < NF)max=NF;};END { for(j=1;j<=max;j++) printf "%d\t",sum[j]/max;}' input

但它将连续分隔符视为一个并将列混合。 非常感谢任何帮助。

1 个答案:

答案 0 :(得分:5)

你可以使用这个单行:

$ awk -F, '{for(i=1; i<=NF; i++) {a[i]+=$i; if($i!="") b[i]++}}; END {for(i=1; i<=NF; i++) printf "%s%s", a[i]/b[i], (i==NF?ORS:OFS)}' foo
2.5 4.5 4.5

否则,您可以将其保存在文件script.awk中并运行awk -f script.awk your_file

{
    for(i=1; i<=NF; i++) {
        a[i]+=$i
        if($i!="") 
            b[i]++}
    } 
END {
    for(i=1; i<=NF; i++) 
        printf "%s%s", a[i]/b[i], (i==NF?ORS:OFS)
}