Нужна помощь в сверке списка и получении итогов в perl - PullRequest
0 голосов
/ 24 ноября 2010

Привет, у меня большой список данных: http://paste -it.net / государственный / y17027d / Это 67859 строк по 10 столбцов. Шестой столбец содержит значения, которые представляют Z-баллы от 1 до 6 с шагом 0,01. Я хотел бы суммировать все другие значения столбцов, которые имеют такое же значение Z-показателя, но мой текущий код не работает.

То, что у меня сейчас есть, печатает значения, но итоговые значения для каждого Z-счета неверны.
Вот мой код:

#! /usr/bin/perl

use strict;
use warnings;
use POSIX;
use Data::Dumper;



my $input = $ARGV[0];
open (DATAFILE, $input) or die $!;
open(OUT,">>"."final.output.txt");

my($line,$fMeasure,$filename,$recall,$precision,$z_score,$computer_calls,$johns_calls,$false_negatives,$false_positives,$true_positives,$count);
$fMeasure=$filename=$recall=$precision=$z_score=$computer_calls=$johns_calls=$false_negatives=$false_positives=$true_positives=$count = 0;




my %stats=();
my %zscore=();
while($line = <DATAFILE>){ 
     # Chop off new line character, skip the comments and empty lines.                 
     chomp($line); 
     my @temp = split(/\t/, $line);
     $true_positives = $temp[0];
     $false_positives = $temp[1];
     $false_negatives = $temp[2];
     $johns_calls = $temp[3];
     $computer_calls = $temp[4];
     $z_score = $temp[5];
     $fMeasure = $temp[6];
     $precision = $temp[7];
     $recall =  $temp[8];
     $filename = $temp[9];
     $stats{$z_score}{$filename}[0] = $true_positives;
     $stats{$z_score}{$filename}[1] = $false_positives;
     $stats{$z_score}{$filename}[2] = $johns_calls;
     $stats{$z_score}{$filename}[3] = $computer_calls;
     $stats{$z_score}{$filename}[4] = $fMeasure;
     $stats{$z_score}{$filename}[5] = $precision;
     $stats{$z_score}{$filename}[6] = $recall;
     $stats{$z_score}{$filename}[6] = $filename;
     $zscore{$z_score}++;

}


my $false_positives_new = 0;
my $true_positives_new = 0;
my $johns_calls_new = 0; 
my $computer_calls_new = 0;
my $file_name = 0;


foreach $z_score ( sort keys %stats ) {
foreach $filename( keys %{$stats{$z_score}} ){
    my $tp = $stats{$z_score}{$filename}[0];
    my $fp = $stats{$z_score}{$filename}[1];
    my $jc = $stats{$z_score}{$filename}[2];
    my $cc = $stats{$z_score}{$filename}[3];
    my $fn = $stats{$z_score}{$filename}[6];
    #print "$z_score\t$jc\n";
    $false_positives_new = $false_positives + $fp;
    $true_positives_new = $true_positives + $tp;
    $johns_calls_new = $johns_calls + $jc; 
    $computer_calls_new = $computer_calls + $cc;

    #print OUT "$fn\n";
}

print OUT"$true_positives_new\t$false_positives_new\t$johns_calls_new\t$computer_calls_new\t$z_score  \n";
$false_positives_new = 0;
$true_positives_new = 0;
$johns_calls_new = 0;
$computer_calls_new = 0;
$file_name = 0;

}



close(OUT);
close (DATAFILE);

Я знаю, что я, должно быть, делаю что-то не так, но я не могу понять, что. Любая помощь будет принята с благодарностью. Спасибо

Ответы [ 2 ]

2 голосов
/ 24 ноября 2010

OK. Мне удалось получить данные из pastebin, и я думаю, что следующий код делает то, что вы хотите.

#! /usr/bin/perl

use strict; use warnings;
use Data::Dumper;

my ($input) = @ARGV;
open my $DATAFILE, '<', $input
    or die "Cannot open '$input': $!";

my @field_names = qw(
    fMeasure
    recall
    precision
    z_score
    computer_calls
    johns_calls
    false_negatives
    false_positives
    true_positives
    count
);

my @track_fields = qw(
    false_positives
    false_negatives
    johns_calls
    computer_calls
);

my (%stats, %by_zscore);

while ( my $line = <$DATAFILE> ) {
    last unless $line =~ /\S/;
    chomp $line;
    my @temp = split /\t/, $line;
    my $filename = pop @temp;

    my %fields;
    @fields{ @field_names } = @temp;

    my $z_score = $fields{z_score};

    $stats{ $z_score }{$filename} = \@temp;

    for my $f ( @track_fields ) {
        $by_zscore{$z_score}{ $f } += $fields{ $f };
    }
}

print Dumper \%by_zscore;
1 голос
/ 24 ноября 2010

Я думаю, что вы хотите сказать

$false_positives_new = $false_positives_new + $fp;
# etc.

вместо

$false_positives_new = $false_positives + $fp;
Добро пожаловать на сайт PullRequest, где вы можете задавать вопросы и получать ответы от других членов сообщества.
...