编码区打分模型 使用六聚体(6-mer)频率的编码区/非编码区对数似然比来评估 一段序列的编码潜力。这是Prodigal cscore的核心。
CodingModel
01 Syntax
SMRUCC.genomics.Annotation.Prodigal.CodingModel
02 Methods
| Name | Overloads | Summary |
|---|---|---|
| BuildModel | 1 | 从训练基因构建编码区和非编码区的六聚体频率模型 |
| ComputeHexamerScores | 1 | 计算每个六聚体的对数似然比得分 score(h) = log2( P(h|coding) / P(h|noncoding) ) |
| ComputeCodingScore | 1 | 计算一个ORF的编码区得分(cscore) cscore = 所有in-frame六聚体的对数似然比之和 / 六聚体数量 |
| InitializeDefaultModel | 1 | 使用默认参数初始化模型(用于第一次迭代) 基于GC含量设置初始六聚体得分 |
03 Fields
| Name | Overloads | Summary |
|---|---|---|
| Pseudocount | 1 | 伪计数,防止零概率 |
04 Members
从训练基因构建编码区和非编码区的六聚体频率模型
ComputeHexamerScores(TrainingModel)
计算每个六聚体的对数似然比得分 score(h) = log2( P(h|coding) / P(h|noncoding) )
ComputeCodingScore(CandidateORF, TrainingModel)
计算一个ORF的编码区得分(cscore) cscore = 所有in-frame六聚体的对数似然比之和 / 六聚体数量
InitializeDefaultModel(TrainingModel,
Double)使用默认参数初始化模型(用于第一次迭代) 基于GC含量设置初始六聚体得分
Pseudocount
伪计数,防止零概率