基因家族分布比例的统计数据(每个基因组的四类家族占比的平均值 + 逐基因组明细)
CategoryPercentDataset
00 Remarks
当基因组的数量非常多的时候,壳基因与云基因会因为基因组数量的累加而在 绝对数量上面远远超过核心基因,但是它们在单个基因组内部的占比其实并不高。 这里通过"单个基因组内部的占比"这个口径来消除基因组数量的影响。
01 Syntax
SMRUCC.genomics.Analysis.PanGenome.ReportJSON.CategoryPercentDataset
02 Properties
| Name | Overloads | Summary |
|---|---|---|
| categories | 1 | 四个家族类别的名称,顺序与 CategoryPercentDataset.byGeneCount / CategoryPercentDataset.byFamilyCount 一致 |
| genomes | 1 | 基因组名称(按名称排序) |
| byGeneCount | 1 | 口径一:某个基因组之内属于该类别的基因(拷贝数)数量占该基因组基因总数的百分比, 再对全部基因组取平均。与 CategoryPercentDataset.categories 同序。 |
| byFamilyCount | 1 | 口径二:某个基因组之内属于该类别的家族个数占该基因组内出现的家族总数的百分比, 再对全部基因组取平均。与 CategoryPercentDataset.categories 同序。 |
| genomeByGeneCount | 1 | [类别][基因组] 口径一的逐基因组百分比明细 |
| genomeByFamilyCount | 1 | [类别][基因组] 口径二的逐基因组百分比明细 |
| colors | 1 | 饼图与条形图所使用的配色,与 CategoryPercentDataset.categories 同序 |
03 Members
categories
四个家族类别的名称,顺序与 CategoryPercentDataset.byGeneCount / CategoryPercentDataset.byFamilyCount 一致
genomes
基因组名称(按名称排序)
byGeneCount
口径一:某个基因组之内属于该类别的基因(拷贝数)数量占该基因组基因总数的百分比, 再对全部基因组取平均。与 CategoryPercentDataset.categories 同序。
byFamilyCount
口径二:某个基因组之内属于该类别的家族个数占该基因组内出现的家族总数的百分比, 再对全部基因组取平均。与 CategoryPercentDataset.categories 同序。
genomeByGeneCount
[类别][基因组] 口径一的逐基因组百分比明细
genomeByFamilyCount
[类别][基因组] 口径二的逐基因组百分比明细
colors
饼图与条形图所使用的配色,与 CategoryPercentDataset.categories 同序