Группа MongoDB по функциональности - PullRequest
7 голосов
/ 07 января 2012

В MySQL

select a,b,count(1) as cnt from list group by a, b having cnt > 2;

Я должен выполнить группу по функции, используя условие в mongodb.Но я получаю следующую ошибку.Пожалуйста, поделитесь своими данными.

В MongoDB

> res = db.list.group({key:{a:true,b:true},
...                      reduce: function(obj,prev) {prev.count++;},
...                      initial: {count:0}}).limit(10);

Sat Jan  7 16:36:30 uncaught exception: group command failed: {
        "errmsg" : "exception: group() can't handle more than 20000 unique keys",
        "code" : 10043,
        "ok" : 0

Как только он будет выполнен, нам нужно запустить следующий файл на следующем.

С уважением, Кумаран

Ответы [ 3 ]

12 голосов
/ 07 января 2012

MongoDB группировка по очень ограничена в большинстве случаев, например

- the result set must be lesser than 10000 keys.
- it will not work in sharded environments

Так что лучше использовать карту уменьшить. поэтому запрос будет выглядеть так

map = function () {emit ({a: true, b: true}, {count: 1}); }

reduce = function(k, values) {
    var result = {count: 0};
    values.forEach(function(value) {
        result.count += value.count;
    });
    return result;
}

, а затем

db.list.mapReduce(map,reduce,{out: { inline : 1}})

Это непроверенная версия. дайте мне знать, если это работает

EDIT:

Предыдущая функция карты была неисправна. Вот почему вы не получаете результаты. это должно было быть

map = function () {
    emit({a:this.a, b:this.b}, {count:1});
}

Данные испытаний:

> db.multi_group.insert({a:1,b:2})
> db.multi_group.insert({a:2,b:2})
> db.multi_group.insert({a:3,b:2})
> db.multi_group.insert({a:1,b:2})
> db.multi_group.insert({a:3,b:2})
> db.multi_group.insert({a:7,b:2})


> db.multi_group.mapReduce(map,reduce,{out: { inline : 1}})
{
    "results" : [
        {
            "_id" : {
                "a" : 1,
                "b" : 2
            },
            "value" : {
                "count" : 2
            }
        },
        {
            "_id" : {
                "a" : 2,
                "b" : 2
            },
            "value" : {
                "count" : 1
            }
        },
        {
            "_id" : {
                "a" : 3,
                "b" : 2
            },
            "value" : {
                "count" : 2
            }
        },
        {
            "_id" : {
                "a" : 7,
                "b" : 2
            },
            "value" : {
                "count" : 1
            }
        }
    ],
    "timeMillis" : 1,
    "counts" : {
        "input" : 6,
        "emit" : 6,
        "reduce" : 2,
        "output" : 4
    },
    "ok" : 1,
}

EDIT2:

Полное решение, включая применение с количеством> = 2

map = function () {
    emit({a:this.a, b:this.b}, {count:1,_id:this._id});
}

reduce = function(k, values) {
    var result = {count: 0,_id:[]};
    values.forEach(function(value) {
        result.count += value.count;
        result._id.push(value._id);
    });
    return result;
}

>db.multi_group.mapReduce(map,reduce,{out: { replace : "multi_result"}})

> db.multi_result.find({'value.count' : {$gte : 2}})
{ "_id" : { "a" : 1, "b" : 2 }, "value" : { "_id" : [   ObjectId("4f0adf2884025491024f994c"),   ObjectId("4f0adf3284025491024f994f") ], "count" : 2 } }
{ "_id" : { "a" : 3, "b" : 2 }, "value" : { "_id" : [   ObjectId("4f0adf3084025491024f994e"),   ObjectId("4f0adf3584025491024f9950") ], "count" : 2 } }
0 голосов
/ 21 апреля 2012

В зависимости от количества ваших групп, вы можете найти более простое и быстрое решение, чем group или MapReduce , используя отдельный :

var res = [];
for( var cur_a = db.list.distinct('a'); cur_a.hasNext(); ) {
  var a = cur_a.next();
  for( var cur_b = db.list.distinct('b'); cur_b.hasNext(); ) {
    var b = cur_b.next();
    var cnt = db.list.count({'a':a,'b':b})
    if (cnt > 2)
      res.push({ 'a': a, 'b' : b 'cnt': cnt}
  }
} 

Будет быстрее, если у вас есть индексы a и b

db.list.ensureIndex({'a':1,'b':1})
0 голосов
/ 07 января 2012

Вы должны использовать MapReduce . Группа имеет свои ограничения.

В будущем вы сможете использовать Aggregation Framework . Но сейчас используйте карту / уменьшить.

...