我有一个如下的Python字典:
{u'2012-06-08': 388,
u'2012-06-09': 388,
u'2012-06-10': 388,
u'2012-06-11': 389,
u'2012-06-12': 389,
u'2012-06-13': 389,
u'2012-06-14': 389,
u'2012-06-15': 389,
u'2012-06-16': 389,
u'2012-06-17': 389,
u'2012-06-18': 390,
u'2012-06-19': 390,
u'2012-06-20': 390,
u'2012-06-21': 390,
u'2012-06-22': 390,
u'2012-06-23': 390,
u'2012-06-24': 390,
u'2012-06-25': 391,
u'2012-06-26': 391,
u'2012-06-27': 391,
u'2012-06-28': 391,
u'2012-06-29': 391,
u'2012-06-30': 391,
u'2012-07-01': 391,
u'2012-07-02': 392,
u'2012-07-03': 392,
u'2012-07-04': 392,
u'2012-07-05': 392,
u'2012-07-06': 392}
键是Unicode日期,值是整数 . 我想通过将日期及其对应的值作为两个单独的列将其转换为pandas数据帧 . 示例:col1:日期col2:DateValue(日期仍为Unicode,日期值仍为整数)
Date DateValue
0 2012-07-01 391
1 2012-07-02 392
2 2012-07-03 392
. 2012-07-04 392
. ... ...
. ... ...
在这方面的任何帮助将不胜感激 . 我无法在大熊猫文档上找到资源来帮助我解决这个问题 .
我知道一个解决方案可能是将此dict中的每个键值对转换为dict,以便整个结构成为dicts的dict,然后我们可以将每一行单独添加到数据帧 . 但我想知道是否有更简单的方法和更直接的方法来做到这一点 .
到目前为止,我已经尝试将dict转换为一个系列对象,但这似乎并没有维持列之间的关系:
s = Series(my_dict,index=my_dict.keys())
11 回答
这里的错误是因为使用标量值调用DataFrame构造函数(其中它期望值为list / dict / ...即具有多列):
您可以从字典中获取项目(即键值对):
但我认为传递Series构造函数更有意义:
正如在这里直接使用
pandas.DataFrame()
的另一个答案所解释的那样,你不会按照你的想法行事 .你可以做的是使用pandas.DataFrame.from_dict和 orient='index' :
将字典的项目传递给DataFrame构造函数,并给出列名称 . 之后解析
Date
列以获取Timestamp
值 .注意python 2.x和3.x之间的区别:
在python 2.x中:
在Python 3.x中:(需要额外的'列表')
将字典转换为pandas数据帧时,您希望键是所述数据帧的列,并且值是行值,您可以简单地在字典周围放置括号,如下所示:
这让我有些头疼,所以我希望它可以帮助那里的人!
Pandas有built-in function用于将dict转换为数据帧 .
对于您的数据,您可以将其转换如下:
在我的情况下,我希望dict的键和值是DataFrame的列和值 . 所以唯一对我有用的是:
您也可以将字典的键和值传递给新的数据帧,如下所示:
接受dict作为参数并返回一个数据帧,其中dict的键为索引,值为列 .
我已经多次遇到这个并且有一个我从函数
get_max_Path()
创建的示例字典,并返回示例字典:{2: 0.3097502930247044, 3: 0.4413177909384636, 4: 0.5197224051562838, 5: 0.5717654946470984, 6: 0.6063959031223476, 7: 0.6365209824708223, 8: 0.655918861281035, 9: 0.680844386645206}
为了将其转换为数据帧,我运行了以下内容:
df = pd.DataFrame.from_dict(get_max_path(2), orient = 'index').reset_index()
返回带有单独索引的简单两列数据框:
index 0 0 2 0.309750 1 3 0.441318
只需使用
f.rename(columns={'index': 'Column1', 0: 'Column2'}, inplace=True)
重命名列我认为您在创建字典时可以对数据格式进行一些更改,然后您可以轻松地将其转换为DataFrame:
输入:
输出:
输入:
输出:将是您的DataFrame
你只需要在像Sublime或Excel这样的地方使用一些文本编辑 .