从pandas数据框创建嵌套字典

Question

从pandas数据框创建嵌套字典

3

我将尝试从Pandas数据框创建一个嵌套字典。

我有以下数据框：

# this code should reproduce the example dataframe below:
df = pd.DataFrame({'ScID.xml': {0: '0006-****(****)050[****:ayfb]2.3.co.xml',
  1: '0006-****(****)050[****:smihds]2.3.co.xml',
  2: '0006-****(****)050[****:gissad]2.3.co.xml'},
 'topic1': {0: 7.26744186046513e-06, 1: 0.0006479109, 2: 3.413e-06},
 'topic2': {0: 7.26744186046513e-06, 1: 0.0091339857, 2: 3.413e-06},
 'topic3': {0: 7.26744186046513e-06, 1: 2.79485746226941e-06, 2: 3.413e-06}})

# example dataframe:
                                    ScID.xml    topic1    topic2    topic3
0    0006-****(****)050[****:ayfb]2.3.co.xml  0.000007  0.000007  0.000007
1  0006-****(****)050[****:smihds]2.3.co.xml  0.000648  0.009134  0.000003
2  0006-****(****)050[****:gissad]2.3.co.xml  0.000003  0.000003  0.000003

我希望您能够创建一个嵌套的字典，就像这样：

new_dict = {
   'topic1': {'0006-****(****)050[****:ayfb]2.3.co.xml': 0.000007,
   '0006-****(****)050[****:smihds]2.3.co.xml': 0.000648,
   '0006-****(****)050[****:gissad]2.3.co.xml': 0.000003},

   'topic2': {'0006-****(****)050[****:ayfb]2.3.co.xml': 0.000007,
   '0006-****(****)050[****:smihds]2.3.co.xml': 0.009134,
   '0006-****(****)050[****:gissad]2.3.co.xml': 0.000003},

   'topic3': {'0006-****(****)050[****:ayfb]2.3.co.xml': 0.000007,
   '0006-****(****)050[****:smihds]2.3.co.xml': 0.000003,
   '0006-****(****)050[****:gissad]2.3.co.xml': 0.000003}
}

其中topicX是键，ScID.xmls是子键。

- Lorcán

2个回答

3

使用DataFrame.set_index和DataFrame.to_dict，参数orient='dict'默认为省略：

d = df.set_index('ScID.xml').to_dict()

print (d)

{'topic1': {'0006-****(****)050[****:ayfb]2.3.co.xml': 7.26744186046513e-06, 
            '0006-****(****)050[****:smihds]2.3.co.xml': 0.0006479109, 
            '0006-****(****)050[****:gissad]2.3.co.xml': 3.413e-06}, 
'topic2': {'0006-****(****)050[****:ayfb]2.3.co.xml': 7.26744186046513e-06, 
           '0006-****(****)050[****:smihds]2.3.co.xml': 0.0091339857, 
          '0006-****(****)050[****:gissad]2.3.co.xml': 3.413e-06}, 
'topic3': {'0006-****(****)050[****:ayfb]2.3.co.xml': 7.26744186046513e-06, 
           '0006-****(****)050[****:smihds]2.3.co.xml': 2.79485746226941e-06, 
           '0006-****(****)050[****:gissad]2.3.co.xml': 3.413e-06}}

- jezrael

网页内容由stack overflow 提供, 点击上面的

可以查看英文原文，
原文链接

- jpp · Accepted Answer

您可以使用set_index方法，然后跟随pd.DataFrame.to_dict方法。

res = df.set_index('ScID.xml').to_dict(orient='dict')

{'topic1': {'0006-****(****)050[****:ayfb]2.3.co.xml': 7.2674418604651302e-06,
  '0006-****(****)050[****:gissad]2.3.co.xml': 3.4130000000000002e-06,
  '0006-****(****)050[****:smihds]2.3.co.xml': 0.0006479109},
 'topic2': {'0006-****(****)050[****:ayfb]2.3.co.xml': 7.2674418604651302e-06,
  '0006-****(****)050[****:gissad]2.3.co.xml': 3.4130000000000002e-06,
  '0006-****(****)050[****:smihds]2.3.co.xml': 0.0091339856999999997},
 'topic3': {'0006-****(****)050[****:ayfb]2.3.co.xml': 7.2674418604651302e-06,
  '0006-****(****)050[****:gissad]2.3.co.xml': 3.4130000000000002e-06,
  '0006-****(****)050[****:smihds]2.3.co.xml': 2.79485746226941e-06}}