1. ホーム
  2. python

[解決済み] Pandasのデータフレームでタプルの列を分割するにはどうしたらいいですか?

2022-06-29 21:07:12

質問

Pandasのデータフレームがあります(これはほんの一部です)。

>>> d1
   y norm test  y norm train  len(y_train)  len(y_test)  \
0    64.904368    116.151232          1645          549
1    70.852681    112.639876          1645          549

                                    SVR RBF  \
0   (35.652207342877873, 22.95533537448393)
1  (39.563683797747622, 27.382483096332511)

                                        LCV  \
0  (19.365430594452338, 13.880062435173587)
1  (19.099614489458364, 14.018867136617146)

                                   RIDGE CV  \
0  (4.2907610988480362, 12.416745648065584)
1    (4.18864306788194, 12.980833914392477)

                                         RF  \
0   (9.9484841581029428, 16.46902345373697)
1  (10.139848213735391, 16.282141345406522)

                                           GB  \
0  (0.012816232716538605, 15.950164822266007)
1  (0.012814519804493328, 15.305745202851712)

                                             ET DATA
0  (0.00034337162272515505, 16.284800366214057)  j2m
1  (0.00024811554516431878, 15.556506191784194)  j2m
>>>

タプルを含む全てのカラムを分割したい。例えば、私はカラムを置き換えたい LCV というカラムに置き換えたい。 LCV-aLCV-b .

どうすればいいのでしょうか?

どのように解決するのですか?

次のようにするとできます。 pd.DataFrame(col.tolist()) をそのカラムに追加します。

In [2]: df = pd.DataFrame({'a':[1,2], 'b':[(1,2), (3,4)]})

In [3]: df
Out[3]:
   a       b
0  1  (1, 2)
1  2  (3, 4)

In [4]: df['b'].tolist()
Out[4]: [(1, 2), (3, 4)]

In [5]: pd.DataFrame(df['b'].tolist(), index=df.index)
Out[5]:
   0  1
0  1  2
1  3  4

In [6]: df[['b1', 'b2']] = pd.DataFrame(df['b'].tolist(), index=df.index)

In [7]: df
Out[7]:
   a       b  b1  b2
0  1  (1, 2)   1   2
1  2  (3, 4)   3   4

注意: 以前のバージョンでは、この回答は df['b'].apply(pd.Series) の代わりに pd.DataFrame(df['b'].tolist(), index=df.index) . これも同様に動作しますが(各タプルの Series を作成し、それをデータフレームの行として見るからです)、この方法は tolist バージョンよりも遅い / メモリを多く消費します。 からdenfromufaまで ).