mongodb - Mongo 查询 - 约束数量与速度(和索引!)

coder 2023-10-28 原文

假设我在数据库中有 100 万个条目，数据库中有 10 个字段/(“列”)。在我看来，我搜索的列越多，查询速度就越快 - 例如:

db.items.find( { 
    $and: [ 
        { field1: x }, 
        { field2: y },
        { field3: z}
    ] 
} )

快于:

db.items.find( { 
    $and: [ 
        { field1: x }, 
        { field2: y }
    ] 
} )

虽然我很想说“太棒了，这对我来说完全有意义”——但事实并非如此。我只知道它发生在我的特殊情况下，想知道这是否真的总是如此。如果是这样，理想情况下，我想知道为什么。

此外，在创建多字段索引时，以任何顺序排列它们是否有帮助。例如，假设我添加了一个 compound index :

db.collection.ensureIndex( { field1: 1, field2: 1, field3: 1 } )

这些有什么顺序吗？如果是，顺序重要吗？假设 90% 的项目将匹配字段 1 条件，但 1% 的项目将匹配字段 3 条件。订购它们会有什么不同吗？

最佳答案

这可能只是限制性更强的查询返回更少文档的情况，因为 90% 的项目将匹配字段 1 条件，而只有 1% 的项目将匹配字段 3 条件。检查什么explain对这两个查询都说。

Mongo 有很好的profiler .试试看。使用不同的索引和不同的查询。当然不在生产数据库上。

索引中字段的顺序很重要。如果你有一个索引 { field1: 1, field2: 1, field3: 1 }
和查询 db.items.find( { field2: x, field3: y })，根本不会使用索引，
对于查询 db.items.find( { field1: x, field3: y }) 它只能部分用于 field1。

另一方面，查询条件的顺序并不重要:
db.items.find( { field1: x, field2: y }) 和
一样好 db.items.find( { field2: y, field1: x }) 并且在这两种情况下都将使用索引。

在选择索引策略时，您应该同时检查数据和典型查询。可能是这样，index intersection对你来说效果更好，而不是单一的复合索引，你可以使用像 { field1: 1}, { field2: 1}, 这样的简单索引来获得更好的总体性能{ field3: 1}，而不是针对不同类型查询的多个复合索引。

检查索引大小到 fit it in memory 也很重要.无论如何，在大多数情况下。

关于mongodb - Mongo 查询 - 约束数量与速度(和索引!)，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/35371551/

有关mongodb - Mongo 查询 - 约束数量与速度(和索引!)的更多相关文章

ruby - ECONNRESET (Whois::ConnectionError) - 尝试在 Ruby 中查询 Whois 时出错 - 2
我正在用Ruby编写一个简单的程序来检查域列表是否被占用。基本上它循环遍历列表，并使用以下函数进行检查。require'rubygems'require'whois'defcheck_domain(domain)c=Whois::Client.newc.query("google.com").available?end程序不断出错(即使我在google.com中进行硬编码)，并打印以下消息。鉴于该程序非常简单，我已经没有什么想法了-有什么建议吗？/Library/Ruby/Gems/1.8/gems/whois-2.0.2/lib/whois/server/adapters/base.
ruby-on-rails - 在 Rails 和 ActiveRecord 中查询时忽略某些字段 - 2
我知道我可以指定某些字段来使用pluck查询数据库。ids=Item.where('due_at但是我想知道，是否有一种方法可以指定我想避免从数据库查询的某些字段。某种反拔？posts=Post.where(published:true).do_not_lookup(:enormous_field) 最佳答案 Model#attribute_names应该返回列/属性数组。您可以排除其中一些并传递给pluck或select方法。像这样:posts=Post.where(published:true).select(Post.attr
HBase Region 简介和建议数量&大小 - 2
Region是HBase数据管理的基本单位,region有一点像关系型数据的分区。region中存储这用户的真实数据，而为了管理这些数据，HBase使用了RegionSever来管理region。Region的结构hbaseregion的大小设置默认情况下，每个Table起初只有一个Region，随着数据的不断写入，Region会自动进行拆分。刚拆分时，两个子Region都位于当前的RegionServer，但处于负载均衡的考虑，HMaster有可能会将某个Region转移给其他的RegionServer。RegionSplit时机：当1个region中的某个Store下所有StoreFile
sql - 查询忽略时间戳日期的时间范围 - 2
我正在尝试查询我的Rails数据库(Postgres)中的购买表，我想查询时间范围。例如，我想知道在所有日期的下午2点到3点之间进行了多少次购买。此表中有一个created_at列，但我不知道如何在不搜索特定日期的情况下完成此操作。我试过:Purchases.where("created_atBETWEEN?and?",Time.now-1.hour,Time.now)但这最终只会搜索今天与那些时间的日期。最佳答案您需要使用PostgreSQL'sdate_part/extractfunction从created_at中提取小时
ruby-on-rails - 协会的 Rails 索引 - 2
我发现自己需要这个。假设cart是一个包含用户列表的模型。defindex_of_itemcart.users.each_with_indexdo|u,i|ifu==current_userreturniendend获取此类关联索引的更简单方法是什么？最佳答案 indexArray上的方法与您的index_of_item方法相同，例如cart.users.index(current_user)返回数组中第一个对象的索引==给obj。如果未找到匹配项，则返回nil。关于ruby-on-
ruby - Rails -- :id attribute? 所需的数据库索引 - 2
因此，当我遵循MichaelHartl的RubyonRails教程时，我注意到在用户表中，我们为:email属性添加了一个唯一索引，以提高find的效率方法，因此它不会逐行搜索。到目前为止，我们一直在根据情况使用find_by_email和find_by_id进行搜索。然而，我们从未为:id属性设置索引。:id是否自动索引，因为它在默认情况下是唯一的并且本质上是顺序的？或者情况并非如此，我应该为:id搜索添加索引吗？最佳答案大多数数据库(包括sqlite，这是RoR中的默认数据库)会自动索引主键，对于RailsMigration
ruby-on-rails - solr 清理查询 - 2
我在Rails上使用带有ruby的solr。一切正常，我只需要知道是否有任何现有代码来清理用户输入，比如以?开头的查询。或* 最佳答案我不知道执行此操作的任何代码，但理论上可以通过查看parsingcodeinLucene来完成并搜索thrownewParseException(只有16个匹配!)。在实践中，我认为您最好只捕获代码中的任何solr异常并显示“无效查询”消息或类似信息。编辑:这里有几个“sanitizer”:http://pivotallabs.com/users/zach/blog/articles/937-s
ruby-on-rails - Rails 3 在一个查询中包含多个表 - 2
我正在为锦标赛开发一个Rails应用程序。我在这个查询中使用了三个模型:classPlayertruehas_and_belongs_to_many:tournamentsclassTournament:destroyclassPlayerMatch"Player",:foreign_key=>"player_one"belongs_to:player_two,:class_name=>"Player",:foreign_key=>"player_two"在tournaments_controller的显示操作中，我调用以下查询:Tournament.where(:id=>params
ruby-on-rails - Sunspot:如何对具有不同值的多个字段进行全文查询？ - 2
我想用sunspot重现以下原始solr查询q=exact_term_text:fooORterm_textv:foo*ORalternate_text:bar*但我无法通过标准的太阳黑子界面理解这是否可能以及如何实现，因为看起来:fulltext方法似乎不接受多个文本/搜索字段参数我不知道将什么参数作为第一个参数传递给fulltext，就好像我通过了"foo"或"bar"结果不匹配如果我传递一个空参数，我得到一个q=*:*范围过滤器(例如with(:term).starting_with('foo*')(顾名思义)作为过滤器查询应用，因此不参与评分。似乎可以手动编写字符串(或者可能使
ruby - 引用具有指定索引的枚举器值 - 2
假设我有一个可枚举对象enum，现在我想获取第三个项目。我知道一种通用方法是转换成数组，然后使用索引访问，如:enum.to_a[2]但这种方式会创建一个临时数组，效率可能很低。现在我使用:enum.each_with_index{|v,i|breakvifi==2}但这非常丑陋和多余。执行此操作最有效的方法是什么？最佳答案你可以使用take剥离前三个元素，然后剥离last从take给你的数组中获取第三个元素:third=enum.take(3).last如果您根本不想生成任何数组，那么也许:#Ifenumisn'tanEnum

mongodb - Mongo 查询 - 约束数量与速度(和索引!)

有关mongodb - Mongo 查询 - 约束数量与速度(和索引!)的更多相关文章

随机推荐