%0 Journal Article
%T 基于改进分层强化学习的CPS指令多目标动态优化分配算法
%A 余涛
%A 王宇名
%A 叶文加
%A 刘前进
%J 中国电机工程学报
%P 90-96
%D 2011
%X 应用经典强化学习方法的控制性能标准(controlperformancestandard，CPS)下自动发电控制(automaticgenerationcontrol，AGC)指令(CPS指令)由调度端至电网各台机组的分配过程不可避免出现维数灾难问题。提出应用分层强化学习的方法，将全网机组按调频时延做初次分类，CPS指令逐层分配形成任务分层结构。在分层Q学习算法层与层之间引入一个时变协调因子，改进的分层Q学习算法有效提高原算法收敛速度。奖励函数中设计不同的权值线性组合，展示保守及乐观控制下系统CPS控制水平和调节成本的变化关系。南方电网统计性仿真分析表明，改进分层Q学习算法较分层Q学习算法平均收敛时间缩短47%，在复杂随机扰动的环境中改进算法能有效提高系统CPS考核合格率，并降低调节成本约5%。
%K 分层强化学习
%K 协调因子
%K 随机优化
%K 控制性能标准
%K 自动发电控制
%U http://www.pcsee.org/CN/abstract/abstract24392.shtml