按数值获取列表中重复列的名称[英] Get lists in list with names of duplicate columns by values

本文是小编为大家收集整理的关于按数值获取列表中重复列的名称的处理方法,想解了按数值获取列表中重复列的名称的问题怎么解决?按数值获取列表中重复列的名称问题的解决办法?那么可以参考本文帮助大家快速定位并解决问题。

问题描述

我有数据框:

import pandas as pd

data = [[101, 1, 2, 10, 3, 2, 3, 1], [5,5, 5, 5, 5, 5, 5, 5], [30, 3, 7, 14, 10, 7, 10, 2], [11, 2, 6, 15, 20, 6, 20, 11]] 

df = pd.DataFrame(data, columns = ['xen', 'sim', 'tab', 'sim', 'simm', 'box', 'simm', 'res'])

看起来像:

|   xen |   sim |   tab |   sim |   simm |   box |   simm |   res |
|------:|------:|------:|------:|-------:|------:|-------:|------:|
|   101 |     1 |     2 |    10 |      3 |     2 |      3 |     1 |
|     5 |     5 |     5 |     5 |      5 |     5 |      5 |     5 |
|    30 |     3 |     7 |    14 |     10 |     7 |     10 |     2 |
|    11 |     2 |     6 |    15 |     20 |     6 |     20 |    11 |

我需要在列表中按值获取具有重复列名称的列表(它可以按名称重复,也可以不重复).对于上面输出的数据框应该是这样的:

[["tab", "box"], ["simm", "simm"]]

推荐答案

IIUC

l=df.T.reset_index().groupby(df.index.tolist())['index'].agg(list).loc[lambda x : x.str.len()>=2].values.tolist()
[['tab', 'box'], ['simm', 'simm']]

本文地址:https://www.itbaoku.cn/post/1728206.html