我希望知道各种项目的第一年收入情况。
给出以下数据框:
ID Y1 Y2 Y3
0 NaN 8 4
1 NaN NaN 1
2 NaN NaN NaN
3 5 3 NaN
我希望能够按行返回第一列非空值的名称。
在这种情况下,我想要返回:
['Y2','Y3',NaN,'Y1']
我的目标是将此列添加到原始数据框中。
以下代码基本上可以工作,但非常笨重。
import pandas as pd
import numpy as np
df = pd.DataFrame({'Y1':[np.nan, np.nan, np.nan, 5],'Y2':[8, np.nan, np.nan, 3], 'Y3':[4, 1, np.nan, np.nan]})
df['first'] = np.nan
for ID in df.index:
row = df.loc[ID,]
for i in range(0,len(row)):
if (~pd.isnull(row[i])):
df.loc[ID,'first'] = row.index[i]
break
返回:
Y1 Y2 Y3 first
0 NaN 8 4 Y2
1 NaN NaN 1 Y3
2 NaN NaN NaN first
3 5 3 NaN Y1
有没有人知道更优雅的解决方案?