Question

我有一个xarray数据集：

ds
<xarray.Dataset>    
Dimensions:  (lat: 360, lon: 720, time: 3652)
Coordinates:
  * lon      (lon) float32 -179.75 -179.25 -178.75 -178.25 -177.75 -177.25     ...
  * lat      (lat) float32 89.75 89.25 88.75 88.25 87.75 87.25 86.75 86.25 ...
* time     (time) datetime64[ns] 2010-01-01 2010-01-02 2010-01-03 ...
Data variables:
dis    (time, lat, lon) float64 nan nan nan nan nan nan nan nan nan...

dis变量中有nans，但整个数组不是nans。维度时间的长度对应于10年的每日数据（3652天）。

我想要做的是获取10个月时间序列的每月平均值，每个月和每个gridsquare（lat，lon）。所以输出数据集将是：

Dimensions:  (lat: 360, lon: 720, time: 12)  #<<< or 'months'

我看到的一个选项几乎就是我想要的：

ds.dis.groupby('time.month').mean()

然而，这个输出只是一个12项数组。即我们失去了纬度和经度。

<xarray.DataArray 'dis' (month: 12)>
array([ 368.26764123,  394.0543304 ,  424.67056092,  476.94943773,
    522.383195  ,  516.37355647,  497.74700652,  472.46993274,
    456.87268206,  402.44729131,  367.41928436,  362.6121917 ])
Coordinates:
* month    (month) int64 1 2 3 4 5 6 7 8 9 10 11 12

我认为使用datetime64方法可能有很简单的方法可以做到这一点，但我一直在努力使用它们。

唉，在写这篇文章时，我已经做了以下工作：

stacked = xr.concat([ds.dis[tlist[month,:],:,:].mean(dim='time',skipna=True) for month in range(0,12)],dim='month')

给出：

<xarray.DataArray 'dis' (month: 12, lat: 360, lon: 720)>

然而，还有另一种pythonic方式更符合使用groupby的第一行代码吗？

由于

Answer 1

为避免聚合每个子阵列中的所有维度，您需要明确提供维度列表：

ds.dis.groupby('time.month').mean('time')

（有一点我们考虑将此作为groupby操作的默认行为，因为它通常是所需的，但是它不清楚如何触发当前默认的所有维度的求和。）

在datetime64维度中的python xarray concat groupby

1 个答案: