Salesforce 大数据量处理篇(二)Index

https://developer.salesforce.com/docs/atlas.en-us.202.0.salesforce_large_data_volumes_bp.meta/salesforce_large_data_volumes_bp/ldv_deployments_infrastructure_indexes.htm

https://baike.baidu.com/item/%E6%95%B0%E6%8D%AE%E5%BA%93%E7%B4%A2%E5%BC%95/8751686?fr=aladdin

https://help.salesforce.com/articleView?id=000325257&type=1&mode=1

https://help.salesforce.com/articleView?id=000334796&type=1&mode=1

https://developer.salesforce.com/blogs/engineering/2013/09/collecting-selectivity-statistics-for-force-com-queries.html

我们在做项目得时候,通常会有需求是根据很多入力条件进行SOQL查询,然后展示 List。好多程序最开始跑的是没有问题得,当数据达到一定数据量比如百万级别以后,可能特别慢,或者更不好的情况下,直接崩溃了。针对这种情况有很多种可能情况导致,其中最常见的一种情况是:你当前的SOQL 语句不是selective的,或者是selective的情况下没有达到最大的优化。那什么样的SOQL语句是selective的,有什么定义或者特点去区分,如何去更好的优化SOQL呢?接下来的内容就抛砖引玉,引出相关的话题。

一. selective的SOQL语句

我们想确定一个SOQL是否为selective的,当前SOQL应该具有以下的特征:

1. where后面的filter的字段应该最少有一个索引字段(字段应该是 indexed的)。索引字段的概念我们后面会单独作为一个部分来讲;

2. 如果filter的字段包含了索引字段,我们将确定一下当前的SOQL返回了多少条数据。针对返回的数据的条数,我们需要看当前的索引字段是标准的索引还是自定义索引。对于标准索引,阈值是第一个百万目标记录的30%,以及第一个百万目标记录之后所有记录的15%。此外,标准索引的选择性阈值最大为100万条总目标记录,只有在总记录数超过560万条时才能达到。对于自定义索引,选择性阈值为第一个百万目标记录的10%,以及第一个百万目标记录之后所有记录的5%。此外,自定义索引的,只有在这个表记录数超过5,6百万条的情况下,选择性阈值最大为333333条目标记录被认为是selective的。

(注:阈值我们可以理解成临界值,即当前的SOQL语句在当前系统通过当前 filter能查询出来的最大值)

举个例子。我们搜索一个自定义表,目前数据量有30万条,因为他是100万条以内,所以如果使用了标准的索引,阈值 = 300000 * 30% = 90000条,也就是说当查询的SQL返回的数据如果使用标准索引只要返回的数量在90000条以内,就代表当前的SOQL是selective的。针对自定义要求是10% * 300000 = 30000条,即返回数据在这个以内代表当前的数据是selective的。

所以一言以蔽之,selective的SOQL的语句具备的特性有两个: 1. filter包含 索引字段;2.查询出来的数据满足当前要求的阈值。只有当前的SOQL是selective的情况下,我们才可以使用工具去进行优化。什么工具呢?看下面。

二. Query Plan Tool

概念和使用暂且不提,先看一下Query Plan Tool如何启用以及在哪里。我们打开 develop console,点击menu部分的help,选择 Preferences,然后弹出的地方我们便可以看到针对 Enable Query Plan的设置,默认就是true代表已经启用,这样我们在下面的 Query Editor中输入相关的SOQL以后,便可以使用 Query Plan Tool来了解官方对当前的SOQL的建议了。

Salesforce 大数据量处理篇(二)Index

使用Query Plan Tool用于SOQL运行缓慢的检测以及优化建议,所以不是所有的场景都需要了解他,当你的数据量特别大,当前SOQL运行特别缓慢,使用它。否则了解这个概念和工具就好。

我们先写一个SQL看一下效果。下图为使用 Query Plan的效果图。包含两个大部分,上面的列表(Plan List)以及下面的Notes部分。

Salesforce 大数据量处理篇(二)Index

 我们看到每个Plan里面都会包括 Cardinality / Fields / Leading Operation Type / Cost / sObject Cardinality / sObject Type。这些列什么含义,如何去理解?

Cardinality(基数):使用 Leading Operation Type操作方式情况下,预估的返回的数据条数;

Fields:查询优化器(Query Optimizer)中使用的索引字段。如果 Leading Operation Type是 索引的,则当前的列将会展示索引字段,如果是全表扫描的模式,则当前的这个列将展示空;

Leading Operation Type:Salesforce将用于优化查询的主要操作类型。这里有4个值:

Index:当前查询的对象使用索引进行查询;

内容版权声明:除非注明,否则皆为本站原创文章。

转载注明出处:https://www.heiqu.com/wpxwsj.html