Регулярное выражение для соответствия неограниченному количеству опций - PullRequest
6 голосов
/ 29 марта 2010

Я хочу иметь возможность разбирать пути к файлам, как этот:

 /var/www/index.(htm|html|php|shtml)

в упорядоченный массив:

 array("htm", "html", "php", "shtml")

и затем составьте список альтернатив:

/var/www/index.htm
/var/www/index.html
/var/www/index.php
/var/www/index.shtml

Сейчас у меня есть preg_match оператор, который может разделить две альтернативы:

 preg_match_all ("/\(([^)]*)\|([^)]*)\)/", $path_resource, $matches);

Может ли кто-нибудь дать мне указатель, как расширить это, чтобы принять неограниченное количество альтернатив (по крайней мере, два)? Что касается регулярного выражения, остальное я могу иметь дело.

Правило:

  • Список должен начинаться с ( и закрываться с )

  • В списке должен быть один | (т. Е. Как минимум две альтернативы)

  • Любые другие вхождения ( или ) должны оставаться нетронутыми.

Обновление: Мне нужно иметь возможность также иметь дело с несколькими парами скобок, такими как:

 /var/(www|www2)/index.(htm|html|php|shtml)

извините, я не сказал этого сразу.

Обновление 2: Если вы хотите сделать то, что я пытаюсь сделать в файловой системе, то обратите внимание, что glob () уже предоставляет эту функциональность из коробки. Нет необходимости реализовывать собственное решение. Подробности смотрите в ответе @ Гордона ниже.

Ответы [ 5 ]

5 голосов
/ 29 марта 2010

Я думаю, что вы ищете:

/ (([^ |] +) (| ([^ |] +)) +) /

По сути, поставьте сплиттер '|' в повторяющийся узор.

Кроме того, ваши слова должны состоять из слов "не трубочек", а не слов "не парней", согласно вашему третьему требованию.

Кроме того, для этой проблемы предпочтительнее от + до *. + означает «хотя бы один». * означает «ноль или более».

4 голосов
/ 29 марта 2010

Не совсем то, что вы спрашиваете, но что плохого в том, чтобы просто взять то, что вам нужно, чтобы получить список (игнорируя | s), поместить его в переменную и затем explode, используя | s? Это дало бы вам массив из множества предметов (включая 1, если не было | подарка).

3 голосов
/ 29 марта 2010

Решение без регулярных выражений:)

<?php

$test = '/var/www/index.(htm|html|php|shtml)';

/**
 *
 * @param string $str "/var/www/index.(htm|html|php|shtml)"
 * @return array "/var/www/index.htm", "/var/www/index.php", etc
 */
function expand_bracket_pair($str)
{
    // Only get the very last "(" and ignore all others.
    $bracketStartPos = strrpos($str, '(');
    $bracketEndPos = strrpos($str, ')');

    // Split on ",".
    $exts = substr($str, $bracketStartPos, $bracketEndPos - $bracketStartPos);
    $exts = trim($exts, '()|');
    $exts = explode('|', $exts);

    // List all possible file names.
    $names = array();

    $prefix = substr($str, 0, $bracketStartPos);
    $affix = substr($str, $bracketEndPos + 1);
    foreach ($exts as $ext)
    {
        $names[] = "{$prefix}{$ext}{$affix}";
    }

    return $names;
}

function expand_filenames($input)
{
    $nbBrackets = substr_count($input, '(');

    // Start with the last pair.
    $sets = expand_bracket_pair($input);

    // Now work backwards and recurse for each generated filename set.
    for ($i = 0; $i < $nbBrackets; $i++)
    {
        foreach ($sets as $k => $set)
        {
            $sets = array_merge(
                $sets,
                expand_bracket_pair($set)
            );
        }
    }

    // Clean up.
    foreach ($sets as $k => $set)
    {
        if (false !== strpos($set, '('))
        {
            unset($sets[$k]);
        }
    }
    $sets = array_unique($sets);
    sort($sets);

    return $sets;
}

var_dump(expand_filenames('/(a|b)/var/(www|www2)/index.(htm|html|php|shtml)'));
2 голосов
/ 29 марта 2010

Может быть, я все еще не понимаю вопрос, но я предполагаю, что вы работаете через файловую систему, пока не нажмете один из файлов, и в этом случае вы можете сделать

$files = glob("$path/index.{htm,html,php,shtml}", GLOB_BRACE);

Полученный массив будет содержать любой файл, соответствующий вашим расширениям, в $ path или ни один. Если вам нужно включить файлы по определенному порядку расширений, вы можете foreach по массиву упорядочить список расширений, например,

foreach(array('htm','html','php','shtml') as $ext) {
    foreach($files as $file) {
        if(pathinfo($file, PATHINFO_EXTENSION) === $ext) {
            // do something
        }
    }
}

Редактировать: и да, в глобусе может быть несколько фигурных скобок.

1 голос
/ 29 марта 2010

Ответ дан, но это забавная головоломка, и я просто не удержался

function expand_filenames2($str) {
    $r = array($str);
    $n = 0;
    while(preg_match('~(.*?) \( ( \w+ \| [\w|]+ ) \) (.*) ~x', $r[$n++], $m)) {
        foreach(explode('|', $m[2]) as $e)
            $r[] = $m[1] . $e . $m[3];
    }
    return array_slice($r, $n - 1);
}  



print_r(expand_filenames2('/(a|b)/var/(ignore)/(www|www2)/index.(htm|html|php|shtml)!'));

возможно, это немного объясняет, почему мы так любим регулярные выражения;)

...