LookupError: индекс времени не найден в кадре данных - PullRequest
0 голосов
/ 13 декабря 2018

Вот код для воспроизведения этой проблемы, но этого можно избежать, удалив сущность "orders".

import featuretools as ft
import pandas as pd
import numpy as np
df = pd.DataFrame({'member_id': ['AAA', 'AAA',  'AAA', 'AAA', 'AAA',  'JJJ', 'JJJ', 'JJJ'],
                   'order_id': ['0001','0001','0001','0002','0002','1111','1111','1111'],
                   'order_datee': ['2011-01-01','2011-01-01','2011-01-01','2014-01-01','2014-01-01','2013-01-01','2013-01-01','2013-01-01'],
                   'member_join_datee': ['2011-01-01','2011-01-01','2011-01-01','2011-01-01','2011-01-01','2012-01-01','2012-01-01','2012-01-01'],
                   'goods_no':['id1','id2','id3','id4','id5','id6','id7','id8'],
                   'amount': [1,     2,      4,     8,      16,     32,   64,     128],
                   'order_amount': [7,     7,      7,     24,      24,     224,   224,     224],
                   'member_lv': [1,     1,      1,     1,      1,     2,   2,     2]})
df


es = ft.EntitySet(id="abc")
es.entity_from_dataframe("purchases",
                         dataframe = df,
                         index = "purchases_index",
                         time_index = 'order_datee',
                         variable_types = {'order_datee': ft.variable_types.Datetime,
                                           'member_join_datee': ft.variable_types.Datetime,
                                           'amount': ft.variable_types.Numeric,
                                           'order_amount': ft.variable_types.Numeric,
                                           'member_lv': ft.variable_types.Numeric,
                                           })

es.normalize_entity(new_entity_id='members',
                    base_entity_id='purchases',
                    index='member_id',
                    make_time_index = 'member_join_datee',
                    additional_variables=['member_join_datee','member_lv'])

es.normalize_entity(new_entity_id='orders',
                    base_entity_id='purchases',
                    index='order_id',
                    make_time_index = 'order_datee',
                    additional_variables=['order_datee','order_amount'])

fm,features = ft.dfs(entityset=es, target_entity='members')

Traceback (most recent call last):
  File "/.../python3.6/site-packages/featuretools/entityset/entityset.py", line 1204, in _import_from_dataframe
    raise LookupError('Time index not found in dataframe')

Ответы [ 2 ]

0 голосов
/ 13 декабря 2018

Проблема в линии additional_variables=['order_datee','order_amount']).Это перемещает столбец order_datee от объекта закупок к объекту заказов.Чтобы скопировать его в объект покупки, не удаляя из объекта заказов, вы должны использовать copy_variables.Например,

es.normalize_entity(new_entity_id='orders',
                    base_entity_id='purchases',
                    index='order_id',
                    make_time_index = 'order_datee',
                    copy_variables=["order_datee"],
                    additional_variables=['order_amount'])

После внесения этих изменений ваш код запускается для меня.

0 голосов
/ 13 декабря 2018

Эта проблема исчезла после удаления 'order_datee' из time_index и Additional_variables для сущности 'orders'.

...