×

AI

清华团队在强化学习领域取得重要进展

hqy hqy 发表于2025-05-23 浏览1 评论0

近日,清华大学车辆与运载学院李克强院士、李升波教授团队在强化学习算法设计领域取得重要进展。团队针对工业对象的智能决策与控制需求,推出了DSAC(Distributional Soft Actor Critic)系列强化学习算法,解决了已有方法值函数学习不准、策略性能低下的难题,并于典型基准测试任务中取得了国际领先的SOTA性能。第一代DSAC算法发表于《IEEE神经网络与学习系统汇刊》(