Question

Предположим, у меня есть следующий фрейм данных:

pd.DataFrame({'col1':    ["a", "a", np.nan, np.nan, np.nan],
            'override1': ["b", np.nan, "b", np.nan, np.nan],
            'override2': ["c", np.nan, np.nan, "c", np.nan]})


    col1    override1   override2
0     a        b          c
1     a       NaN        NaN
2     NaN      b         NaN
3     NaN     NaN         c
4     NaN     NaN         NaN

Есть ли способ свести 3 столбца в один столбец, где override2 переопределяет override1, что переопределяет col1, однако, если есть NaN, то значения bofore должны быть сохранены? Кроме того, я в основном ищу способ, которым мне не пришлось бы делать дополнительную колонку. Я действительно ищу встроенное решение для панд.

Это вывод, который я ищу:

 collapsed
0  c
1  a
2  b
3  c
4  NaN

piRSquared · Answer 1 · 13 июня 2019

Производительность НЕ в виду, а скорее красота и элегантность (-:

df.stack().groupby(level=0).last().reindex(df.index)

0      c
1      a
2      b
3      c
4    NaN
dtype: object

cs95 · Answer 2 · 13 июня 2019

Простое решение включает в себя прямое заполнение и отбор последнего столбца.Это было упомянуто в комментариях.

df.ffill(1).iloc[:,-1].to_frame(name='collapsed')

  collapsed
0         c
1         a
2         b
3         c
4       NaN

Если вы заинтересованы в производительности, мы можем использовать модифицированную версию функции выравнивания Divakar:

pd.DataFrame({'collapsed': justify(
    df.values, invalid_val=np.nan, axis=1, side='right')[:,-1]
})

  collapsed
0         c
1         a
2         b
3         c
4       NaN

Справочник.

def justify(a, invalid_val=0, axis=1, side='left'):    
    """
    Justifies a 2D array

    Parameters
    ----------
    A : ndarray
        Input array to be justified
    axis : int
        Axis along which justification is to be made
    side : str
        Direction of justification. It could be 'left', 'right', 'up', 'down'
        It should be 'left' or 'right' for axis=1 and 'up' or 'down' for axis=0.

    """

    if invalid_val is np.nan:
        mask = pd.notna(a)   # modified for strings
    else:
        mask = a!=invalid_val
    justified_mask = np.sort(mask,axis=axis)
    if (side=='up') | (side=='left'):
        justified_mask = np.flip(justified_mask,axis=axis)
    out = np.full(a.shape, invalid_val) 
    if axis==1:
        out[justified_mask] = a[mask]
    else:
        out.T[justified_mask.T] = a.T[mask.T]
    return out

Divakar · Answer 3 · 13 июня 2019

С акцентом на производительность, вот один с NumPy -

In [106]: idx = df.shape[1] - 1 - df.notnull().to_numpy()[:,::-1].argmax(1)

In [107]: pd.Series(df.to_numpy()[np.arange(len(df)),idx])
Out[107]: 
0      c
1      a
2      b
3      c
4    NaN
dtype: object

yatu · Answer 4 · 13 июня 2019

Вот один из подходов:

df.lookup(df.index , df.notna().cumsum(1).idxmax(1))
# array(['c', 'a', 'b', 'c', nan], dtype=object)

Или эквивалентно работать с базовыми numpy массивами и изменять idxmax с ndarray.argmax:

df.values[df.index, df.notna().cumsum(1).values.argmax(1)]
# array(['c', 'a', 'b', 'c', nan], dtype=object)

Jainil Patel · Answer 5 · 13 июня 2019

import pandas as pd
import numpy as np
df=pd.DataFrame({'col1':    ["a", "a", np.nan, np.nan, np.nan],
            'override1': ["b", np.nan, "b", np.nan, np.nan],
            'override2': ["c", np.nan, np.nan, "c", np.nan]})

print(df)
df=df['col1'].fillna('') + df['override1'].fillna('')+ df['override2'].fillna('')
print(df)

Как свернуть столбцы в пандах на нулевые значения?

Пожалуйста, войдите или зарегистрируйтесь чтобы ответить на этот вопрос.

Ответы [ 6 ]

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Как свернуть столбцы в пандах на нулевые значения?

Пожалуйста, войдите или зарегистрируйтесь чтобы ответить на этот вопрос.

Ответы [ 6 ]

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Пожалуйста, войдите или зарегистрируйтесь что бы добавить комментарий.

Похожие темы