Я пытаюсь добавить около 40-50k строк в базу данных pgsql из Django из дампа текстового файла из приложения для обработки данных
Ниже приводится моя функция
def populate_backup_db(dumpfile):
sensordata=sensorrecords() **** This is the Model
start_time = time.time()
file= open(dumpfile)
filedata = file.readlines()
endcount=len(filedata)
i=0
imagecount=0
while i<endcount:
lineitem = split_entry(filedata[i])
if (lineitem[0]== "HEADER"):
imagecount=imagecount+1
sensordata.Sensor = lineitem[1]
sensordata.Date1 = lineitem[2]
sensordata.Date2 = lineitem[3]
sensordata.Version = lineitem[4]
sensordata.Proxyclient = lineitem[8]
sensordata.Triggerdate = ctodatetime(lineitem[13])
sensordata.Compression = lineitem[16]
sensordata.Encryption = lineitem[17]
sensordata.Fragments = lineitem[21]
sensordata.Pbit = lineitem[37]
sensordata.BlockIntFT = lineitem[38]
sensordata.OriginServer = lineitem[56]
sensordata.save()
i=i+1
elapsed_time = time.time() - start_time
print(imagecount ,'entries saved to database from ',dumpfile,'. Time Taken is ',elapsed_time,' seconds.')
file.close()
Этозаймет около 2-3 минут, чтобы сохранить все данные в базу данных.Этот файл дампа, вероятно, увеличится в размере, и если эта функция будет использоваться, сохранение всех данных в базу данных может занять несколько минут
Как извлечь все данные из файла дампа и затем сохранить еговсе в базу данных за один раз.
EDIT
Я вижу метод DJANGO с именем bulk_create ()
bulk_create()¶
bulk_create(objs, batch_size=None, ignore_conflicts=False)¶
Этот метод вставляет предоставленныйсписок объектов в базе данных эффективным способом (как правило, только 1 запрос, независимо от того, сколько там объектов):
>>> Entry.objects.bulk_create([
... Entry(headline='This is a test'),
... Entry(headline='This is only a test'),
... ])
Пример, кажется, добавляет записи вручную, Используемая мной функция выполняетсяцикл, пока все записи не будут выбраны, сохраняя в процессе.
Как мне запустить его в цикле?Заменить sensordata.save()
на some_list.append(sensordata)
и в конце после окончания цикла сделать
sensordata.objects.bulk_create(some_list)
РЕДАКТИРОВАТЬ 2
Я отредактировал свой код, чтобы добавить объект в список, а затем выполнить массовое обновление в конце, как показано ниже
def populate_backup_db(dumpfile):
sensordata=sensorrecords() **** This is the Model
datalist =[]
start_time = time.time()
file= open(dumpfile)
filedata = file.readlines()
endcount=len(filedata)
i=0
imagecount=0
while i<endcount:
lineitem = split_entry(filedata[i])
if (lineitem[0]== "HEADER"):
imagecount=imagecount+1
sensordata.Sensor = lineitem[1]
sensordata.Date1 = lineitem[2]
sensordata.Date2 = lineitem[3]
sensordata.Version = lineitem[4]
sensordata.Proxyclient = lineitem[8]
sensordata.Triggerdate = ctodatetime(lineitem[13])
sensordata.Compression = lineitem[16]
sensordata.Encryption = lineitem[17]
sensordata.Fragments = lineitem[21]
sensordata.Pbit = lineitem[37]
sensordata.BlockIntFT = lineitem[38]
sensordata.OriginServer = lineitem[56]
datalist.append(sensordata)
i=i+1
elapsed_time = time.time() - start_time
print(imagecount ,'entries saved to database from ',dumpfile,'. Time Taken is ',elapsed_time,' seconds.')
sensordata.objects.bulk_create(datalist)
file.close()
. Это приводит к ошибке ниже
Трассировка:
File "C:\Python\Python36\lib\site-packages\django\core\handlers\exception.py" in inner
34. response = get_response(request)
File "C:\Python\Python36\lib\site-packages\django\core\handlers\base.py" in _get_response
126. response = self.process_exception_by_middleware(e, request)
File "C:\Python\Python36\lib\site-packages\django\core\handlers\base.py" in _get_response
124. response = wrapped_callback(request, *callback_args, **callback_kwargs)
File "C:\Python\Python36\lib\site-packages\django\contrib\auth\decorators.py" in _wrapped_view
21. return view_func(request, *args, **kwargs)
File "C:\Users\va\eclipse-workspace\prod\home\views.py" in process_data
68. get_backup_data()
File "C:\Users\va\eclipse-workspace\prod\home\process.py" in get_backup_data
8. populate_backup_db('c:\\users\\va\\desktop\\vsp\\backupdata_server.txt')
File "C:\Users\va\eclipse-workspace\prod\home\process.py" in populate_backup_db
122. backupdata.objects.bulk_create(backuplist)
File "C:\Python\Python36\lib\site-packages\django\db\models\manager.py" in __get__
176. raise AttributeError("Manager isn't accessible via %s instances" % cls.__name__)
Exception Type: AttributeError at /process_data/
Exception Value: Manager isn't accessible via backuprecords instances