今日动态 返回首页
会员注册 登录 生物通快讯免费订阅
  • 首页 今日动态 人才市场 新技术专栏 中国科学人 云展台
    BioHot
    • 定制我的BioHot
    • 进入我的BioHot
    • 进入我的集采
    • 肿瘤癌症研究
    • 免疫/基因/细胞疗法
    • 神经生物学
    • 健康与疾病
    • 衰老机制与长寿
    • 单细胞技术
    • 基因编辑-CRISPR
    • RNA研究
    • 肠道菌与人体微生态
    • 细胞代谢
    • AI生物信息学
    • COVID
    云讲堂直播 会展中心 特价专栏 技术快讯 免费试用

  • 生物通官微
    陪你抓住生命科技
    跳动的脉搏

生物通首页  >  今日动态  >  正文

基于邻域感知的时空协调分布式多智能体强化学习在交通网络信号控制中的应用

《Scientific Reports》:Distributed multi-agent reinforcement learning with neighborhood-aware spatio-temporal coordination for traffic network signal control

【字体: 大 中 小 】 时间:2026年08月14日 来源:Scientific Reports 4.9

编辑推荐:

  摘要交通拥堵严重制约着城市的经济活力与环境可持续性。基于深度强化学习的交通信号控制技术虽为解决这一问题提供了有效途径,但现有的多智能体方法往往依赖于关于空间依赖关系的静态假设,或需要借助大量全局信息进行集中训练,这限制了它们适应动态变化的交通状况的能力。为弥补这一缺陷,我们提出了

  

摘要

交通拥堵严重制约着城市的经济活力与环境可持续性。基于深度强化学习的交通信号控制技术虽为解决这一问题提供了有效途径,但现有的多智能体方法往往依赖于关于空间依赖关系的静态假设,或需要借助大量全局信息进行集中训练,这限制了它们适应动态变化的交通状况的能力。为弥补这一缺陷,我们提出了一种基于时空注意力网络与邻域信息共享的多智能体强化学习框架——SANIS-MARL。其核心创新在于一种协同的时空建模架构,该架构能够精准捕捉交通随时间的变化与相邻交叉口之间的空间交互关系。在时间维度上,我们结合多头注意力机制与长短期记忆网络,以描述不同时间尺度上的时间依赖性;在空间维度上,图注意力网络v2能够根据实时交通状况动态评估相邻交叉口的重要性。此外,该框架还设计了邻域信息共享机制,通过地理邻近性构建邻域,并利用空间注意力动态调整各交叉口的影响权重。这样的设计有助于实现有效的局部协调,同时缓解多智能体强化学习中常见的非平稳性问题。在城市交通网络上的实验表明,与传统方法及最先进的MADRL控制器相比,SANIS-MARL在减少队列长度、等待时间、行驶时间以及降低污染物排放方面表现更为出色。注意力热图的分析进一步验证了该方法能够有效识别交通拥堵波的先兆特征,为可解释且具有扩展性的协同交通信号控制提供了新的思路。

相关新闻
生物通微信公众号
生物通新浪微博
微信
新浪微博
我要投稿
  • 搜索
  • 国际
  • 国内
  • 人物
  • 产业
  • 热点
  • 科普

热搜:交通信号控制|多智能体强化学习|时空注意力网络|协同建模|共识机制|城市拥堵缓解

热点排行

    今日动态 | 人才市场 | 新技术专栏 | 中国科学人 | 云展台 | BioHot | 云讲堂直播 | 会展中心 | 特价专栏 | 技术快讯 | 免费试用

    版权所有 生物通

    Copyright© eBiotrade.com, All Rights Reserved

    联系信箱:

    粤ICP备09063491号