Функция vlookup между двумя файлами и добавление совпадений в EOL - PullRequest
0 голосов
/ 11 октября 2018

Требуется vlookup из двух разных файлов, имеющих несколько записей:

cat file1.csv

aaaaaaa;24/09/2018;06/09/2018;1;89876768
bbbbbbb;15/09/2018;03/09/2018;2;76958489
ccccccc;10/09/2018;28/08/2018;3;57848472
ddddddd;22/09/2018;08/09/2018;4;17929730
eeeeeee;19/09/2018;30/08/2018;5;18393770

cat file2.csv

20180901;abc;1
20180901;sdf;2
20180904;jhh;2
20180905;skf;3
20180911;asf;2
20180923;ghf;4
20180925;asb;4
20180918;mnj;3

Дополнительно для file1.csv, четвертый столбец - это идентификатор третьего столбца в file2.csv.

Требуется вывод:

aaaaaaa;24/09/2018;06/09/18;1;89876768;20180901
bbbbbbb;15/09/2018;03/09/18;2;76958489;20180901;20180904;20180911
ccccccc;10/09/2018;28/08/18;3;57848472;20180905;20180918
ddddddd;22/09/2018;08/09/18;4;17929730;20180923;20180925
eeeeeee;19/09/2018;30/08/18;5;18393770;unknown

1 Ответ

0 голосов
/ 11 октября 2018

Не могли бы вы попробовать следующее.

awk 'BEGIN{FS=OFS=";"}FNR==NR{a[$NF]=a[$NF]?a[$NF] OFS $1:$1;next} {print ($4 in a)?$0 OFS a[$4]:$0 OFS "unknown"}' file2.csv  file1.csv

Вывод будет следующим.

aaaaaaa;24/09/2018;06/09/2018;1;89876768;20180901
bbbbbbb;15/09/2018;03/09/2018;2;76958489;20180901;20180904;20180911
ccccccc;10/09/2018;28/08/2018;3;57848472;20180905;20180918
ddddddd;22/09/2018;08/09/2018;4;17929730;20180923;20180925
eeeeeee;19/09/2018;30/08/2018;5;18393770;unknown

Объяснение кода:

awk '
BEGIN{                                              ##Starting BEGIN section for awk here.
  FS=OFS=";"                                        ##Setting values for FS and OFS as semi colon.
}                                                   ##Closing block for BEGIN section here.
FNR==NR{                                            ##Checking condition FNR==NR which will be TRUE when first Input_file named file2.csv is being read.
  a[$NF]=a[$NF]?a[$NF] OFS $1:$1                    ##Creating an array named a whose index is $NF and value is $1 and concatenating its own value with same index.
  next                                              ##next will skip all further statements from here.
}                                                   ##Closing block for FNR==NR condition here.
{
  print ($4 in a)?$0 OFS a[$4]:$0 OFS "unknown"     ##These statements will execute when 2nd Input_file is being read and printing value of $0 with condition if $4 is present in array a then concatenate its value with current line else concatenate unknown with it.
}' file2.csv  file1.csv                             ##Mentioning Input_file names here.
Добро пожаловать на сайт PullRequest, где вы можете задавать вопросы и получать ответы от других членов сообщества.
...