|
计算机应用 2009
基于非线性支持向量机的原核生物基因识别Keywords: 基因识别,非线性最小二乘支持向量机,原核生物,gc含量,z曲线,t检验 Abstract: ?应用非线性最小二乘支持向量机对原核生物进行基因识别,通过寻找序列开放阅读框(orf),并与可靠基因位点文件进行比较产生训练样本集,然后提取样本gc含量和z曲线特征,并利用t检验方法检验各特征值所包含的信息量,设计出了非线性最小二乘支持向量机分类器识别基因。结果表明非线性最小二乘支持向量机的识别率比fisher判别和线性支持向量机在不同的特征组合下分别提高了7.09%~29.97%和10.97%~25.45%,并且在特征值信息量较小的情况下非线性最小二乘支持向量机更能表现其优越性。
|