%0 Journal Article %T 基于改进分层强化学习的CPS指令多目标动态优化分配算法 %A 余涛 %A 王宇名 %A 叶文加 %A 刘前进 %J 中国电机工程学报 %P 90-96 %D 2011 %X 应用经典强化学习方法的控制性能标准(controlperformancestandard,CPS)下自动发电控制(automaticgenerationcontrol,AGC)指令(CPS指令)由调度端至电网各台机组的分配过程不可避免出现维数灾难问题。提出应用分层强化学习的方法,将全网机组按调频时延做初次分类,CPS指令逐层分配形成任务分层结构。在分层Q学习算法层与层之间引入一个时变协调因子,改进的分层Q学习算法有效提高原算法收敛速度。奖励函数中设计不同的权值线性组合,展示保守及乐观控制下系统CPS控制水平和调节成本的变化关系。南方电网统计性仿真分析表明,改进分层Q学习算法较分层Q学习算法平均收敛时间缩短47%,在复杂随机扰动的环境中改进算法能有效提高系统CPS考核合格率,并降低调节成本约5%。 %K 分层强化学习 %K 协调因子 %K 随机优化 %K 控制性能标准 %K 自动发电控制 %U http://www.pcsee.org/CN/abstract/abstract24392.shtml