将Python字典转换为数据框架

我有一本Python字典，如下所示:

{u'2012-06-08': 388,
 u'2012-06-09': 388,
 u'2012-06-10': 388,
 u'2012-06-11': 389,
 u'2012-06-12': 389,
 u'2012-06-13': 389,
 u'2012-06-14': 389,
 u'2012-06-15': 389,
 u'2012-06-16': 389,
 u'2012-06-17': 389,
 u'2012-06-18': 390,
 u'2012-06-19': 390,
 u'2012-06-20': 390,
 u'2012-06-21': 390,
 u'2012-06-22': 390,
 u'2012-06-23': 390,
 u'2012-06-24': 390,
 u'2012-06-25': 391,
 u'2012-06-26': 391,
 u'2012-06-27': 391,
 u'2012-06-28': 391,
 u'2012-06-29': 391,
 u'2012-06-30': 391,
 u'2012-07-01': 391,
 u'2012-07-02': 392,
 u'2012-07-03': 392,
 u'2012-07-04': 392,
 u'2012-07-05': 392,
 u'2012-07-06': 392}

键是Unicode日期，值是整数。我想通过将日期和它们对应的值作为两个单独的列来将其转换为熊猫数据框架。示例:col1: Dates col2: DateValue(日期仍然是Unicode, datevalues仍然是整数)

     Date         DateValue
0    2012-07-01    391
1    2012-07-02    392
2    2012-07-03    392
.    2012-07-04    392
.    ...           ...
.    ...           ...

任何在这方面的帮助都将不胜感激。我无法在熊猫文档上找到资源来帮助我。

我知道一个解决方案可能是将这个字典中的每个键-值对转换为一个字典，这样整个结构就变成了字典的字典，然后我们可以将每一行单独添加到数据帧中。但是我想知道是否有更简单更直接的方法。

到目前为止，我已经尝试将字典转换为一个系列对象，但这似乎没有保持列之间的关系:

s  = Series(my_dict,index=my_dict.keys())

当前回答

接受一个dict作为参数，并返回一个数据框架，其中dict的键作为索引，值作为列。

def dict_to_df(d):
    df=pd.DataFrame(d.items())
    df.set_index(0, inplace=True)
    return df

2015-08-19 18:47:59

其他回答

d = {'Date': list(yourDict.keys()),'Date_Values': list(yourDict.values())}
df = pandas.DataFrame(data=d)

如果你没有在list()中封装你的dict .keys()，那么你最终会发现你所有的键和值都被放在每一列的每一行中。是这样的:

日期\ 0(2012-06-08, 2012-06-09, 2012-06-10, 2012-06-1… 1(2012-06-08, 2012-06-09, 2012-06-10, 2012-06-1… 2(2012-06-08, 2012-06-09, 2012-06-10, 2012-06-1… 3(2012-06-08, 2012-06-09, 2012-06-10, 2012-06-1… 4(2012-06-08, 2012-06-09, 2012-06-10, 2012-06-1…

但是通过添加list()，结果是这样的:

日期Date_Values 0 2012-06-08 388 1 2012-06-09 388 2 2012-06-10 388 3 2012-06-11 389 4 2012-06-12 389 .．.

2019-01-30 06:39:36

在我的情况下，我希望字典的键和值是DataFrame的列和值。所以唯一对我有用的是:

data = {'adjust_power': 'y', 'af_policy_r_submix_prio_adjust': '[null]', 'af_rf_info': '[null]', 'bat_ac': '3500', 'bat_capacity': '75'} 

columns = list(data.keys())
values = list(data.values())
arr_len = len(values)

pd.DataFrame(np.array(values, dtype=object).reshape(1, arr_len), columns=columns)

2017-08-17 09:42:12

这是我的工作，因为我想有一个单独的索引列

df = pd.DataFrame.from_dict(some_dict, orient="index").reset_index()
df.columns = ['A', 'B']

2019-10-23 10:03:25

在普通字典上的%timeit结果和pd. datafame .from_dict()是明显的赢家。

%timeit cols_df = pd.DataFrame.from_dict(clu_meta,orient='index',columns=['Columns_fromUser'])
214 µs ± 9.38 µs per loop (mean ± std. dev. of 7 runs, 1000 loops each)

%timeit pd.DataFrame([clu_meta])
943 µs ± 10.6 µs per loop (mean ± std. dev. of 7 runs, 1000 loops each)

%timeit pd.DataFrame(clu_meta.items(), columns=['Default_colNames', 'Columns_fromUser'])
285 µs ± 7.91 µs per loop (mean ± std. dev. of 7 runs, 1000 loops each)

2022-11-25 02:14:12

重点是如何将每个元素放入一个DataFrame中。

Row-wise:

pd.DataFrame(dic.items(), columns=['Date', 'Value'])

或columns-wise:

pd.DataFrame([dic])

2022-03-06 07:16:24

将Python字典转换为数据框架

推荐文章

最新文章

标签