大Pandas堆叠数据帧重塑

dfTrain = pd.read_csv("agr_hi_train.csv") dfTrain2 = pd.read_csv("english/agr_en_train.csv") dfTrain2.reset_index() frames = [dfTrain, dfTrain2] test = dfTrain2.append(dfTrain, ignore_index=True) test2 = dfTrain2.append(dfTrain) test3 = pd.concat(frames, axis=0, ignore_index=True) test4 = pd.merge(dfTrain,dfTrain2, right_index=True, left_index=True)

1条回答

网友

1楼 · 发布于 2024-10-06 07:08:15

如果您有不同的列名，那么您的append将分隔这些列。例如：

dfTrain = pd.DataFrame(np.random.rand(8200, 3), columns=['A', 'B', 'C'])
dfTrain2 = pd.DataFrame(np.random.rand(11998, 3), columns=['D', 'E', 'F'])
test = dfTrain.append(dfTrain2)
print(test)

具有输出：

          A         B         C         D         E         F
0      0.617294  0.507264  0.330792       NaN       NaN       NaN
1      0.439806  0.355340  0.757864       NaN       NaN       NaN
2      0.740674  0.332794  0.530613       NaN       NaN       NaN
...
20195       NaN       NaN       NaN  0.295392  0.621741  0.255251
20196       NaN       NaN       NaN  0.096586  0.841174  0.392839
20197       NaN       NaN       NaN  0.071756  0.998280  0.451681

如果重命名两个dataframes中的列以匹配，那么它将对齐

dfTrain2.columns = ['A','B','C']
test2 = dfTrain.append(dfTrain2)
print(test2)

          A         B         C
0      0.545936  0.103332  0.939721
1      0.258807  0.274423  0.262293
2      0.374780  0.458810  0.955040
...
[20198 rows x 3 columns]

相关问题更多 >

编程相关推荐

热门问题

热门文章

大Pandas堆叠数据帧重塑

相关问题 更多 >

编程相关推荐

热门问题

热门文章

相关问题更多 >